共 110 篇相关文章

Greplica是一款开源的自更新Wiki工具,专为编程代理设计,能从编程会话中自动提取决策、约束和陷阱等隐性知识,实现跨代理、跨开发者的代码库记忆共享,支持本地运行和托管部署。

详解通过Ollama本地运行Claude Code时遇到的API报错、输出token上限、模型卡死等常见问题,提供模型选择、参数调优及替代工具推荐等实用解决方案。

Cursor AI编程工具被指控在关闭遥测后仍上传用户代码到服务器。本文深入分析争议真相、隐私模式工作原理,并为企业开发者提供实用的安全排查建议和替代方案。

深入解析Spring AI框架的核心特性,包括提供商无关的统一API抽象、RAG检索增强生成、结构化输出等能力,帮助Java开发者快速构建企业级AI应用。

基于Spring AI 2.0框架,结合RAG检索增强生成技术与Cursor AI编程,从零搭建企业级知识库智能问答系统。涵盖Ollama本地部署、Redis向量存储、多格式文档解析、引用溯源等核心功能,4GB显存即可本地运行。

Ollama上架Kimi 3模型却要求用户额外按量付费,打破了此前订阅套餐覆盖所有开源模型的预期,引发社区激烈讨论。本文分析争议始末、开源权重与免费使用的区别,以及AI服务定价分层的趋势。

Ollama紧急扩容迎接万亿参数级开源模型,Kimi K3、Qwen 3.8等即将开源。同期Hugging Face向OpenAI提出1亿美元安全补偿,阿里Coder移动端上线,DeepSeek暂停融资。一文梳理开源大模型生态最新动态。

手把手拆解本地离线RAG应用的完整构建思路:基于Ollama、ChromaDB与Flask,实现PDF文档分块、向量化检索与受控生成,全程无需云端API,敏感文档零泄露风险。适合想入门RAG或重视数据隐私的开发者。

手把手教你用Cherry Studio、MCP协议和Ollama搭建本地AI智能体与知识库,涵盖环境配置、文件操作、网页爬取、终端控制及本地RAG知识库全流程,数据不出本地,隐私有保障。

手把手教你将ChatGPT桌面端接入本地大模型,实现零成本、无限Token、数据完全本地化。涵盖Ollama直连方案与CC Switch中转方案,兼容LM Studio、llama.cpp、vLLM,同样适用于Claude Code等AI智能体。

详解如何用Ollama、ChromaDB和Flask搭建完全离线的RAG应用,实现PDF文档本地问答。涵盖文档切分、向量化存储、检索增强生成及防幻觉设计,数据不出本地,无需API付费。

深入解析LangChain框架核心定位、架构原理与学习路径。涵盖RAG应用开发、智能体(Agent)构建、版本选择(0.3/1.0)及六大核心组件,帮助Java/Python开发者快速掌握大模型应用开发技能,轻松应对15K+岗位需求。

一位大学生围绕Ollama构建了近4万行代码的Mac应用,核心是与聊天模型彻底解耦的持久记忆系统:独立嵌入模型+本地向量索引+自愈机制,切换8B/32B模型时记忆无缝延续,附带AES256加密保险库与本地语音模式。

想用本地Ollama运行Gemma 3 12B并将其打造成AI Agent?本文系统讲解工具调用、n8n/LangChain/CrewAI框架对比、上下文限制等实战要点,助你快速构建可落地的本地智能体。

一周内OpenAI、xAI、谷歌、微软四大AI厂商同时降价,近前沿推理成本大幅下探;微软Copilot在4.5亿席位中付费转化率不足4.5%,揭示通用AI助手的变现困境。本文梳理GPT-5.6、Grok 4.5、Gemini延期、DeepSeek API退役等关键事件及开发者应对策略。

手把手拆解本地RAG应用的完整构建思路:Ollama本地模型 + ChromaDB向量数据库 + Flask,实现PDF文档问答、完全离线运行、数据零泄露。适合想入门RAG的开发者快速上手。

在32GB内存Mac上搭建本地AI编程代理的完整方案:Ollama提供本地推理引擎,OpenCode承担代理框架,MCP记忆服务器实现跨会话上下文保持。代码不出本机,无需订阅费用,兼顾隐私与效率。

一台32GB服务器,8小时搭建完整家庭自托管生态。本文详解Jellyfin、Forgejo、Immich、Ollama等核心服务的选型逻辑,以及Nginx Proxy Manager、Podman Compose等基础设施搭建要点,助你掌控自己的数字生活。