共 440 篇相关文章

深入解析MCP(模型上下文协议)的核心价值、三大角色架构与工程实践。通过课程通知MCP服务器实战案例,讲解如何用FastMCP构建服务端、用LangChain加载MCP工具,并给出本地工具与MCP工具的对比及三条设计建议。

开发者在Mac Studio上实测运行Qwen 27B大模型,详解统一内存架构优势、量化策略选择、tokens/s实际表现,以及本地部署大模型的成本与隐私考量。

探索Nexagora多智能体社交网络实验:AI智能体通过API自主对话,人类仅作为旁观者。深入分析人格漂移、上下文窗口饱和、群体极化等涌现行为,解读自主智能体架构设计与多智能体协作的未来。

Ornith AI 发布 Ornith 1.5 系列三款开源模型,涵盖 9B 稠密模型、35B-A3B MoE 架构和 397B 旗舰模型,同步提供 GGUF 量化版本支持本地部署,覆盖从消费级显卡到研究机构的多层次需求。

英伟达签署公开信力挺开放模型,阐述其在安全、创新扩散和技术主权方面的核心价值。本文深度解析英伟达的战略动机,以及开放模型与闭源模型并存的产业逻辑。

阿里通义千问Qwen3.8 27B在Artificial Analysis评测中获得52分,凭借27B参数量逼近旗舰大模型水平。本文解析其性能表现、本地部署优势及对开源模型竞争格局的深远影响。

详细实测AiCode安卓开源AI编程工具,涵盖API提供商配置、容器环境安装、MCP协议扩展、Token成本统计、Git版本管理等完整功能,手把手教你在手机上搭建AI编程环境。

深度解析Qwen 3.8 Flash Next开源模型,探讨其以半激活参数超越DeepSeek V4 Flash的混合架构原理、实际性能表现及对开发者的部署价值,并展望Qwen 4正式版走向。

用户发现Google Gemini对话历史与账户活动日志存在持续性不一致,引发AI数据透明度与隐私合规担忧。本文分析技术原因、合规风险及用户应对措施。

Ollama Cloud Pro用户反映DeepSeek模型额度消耗突然加速,不到一小时触及上限。本文从token计费机制、模型版本迭代、计费权重调整等角度深入分析原因,并提供实用的额度优化建议。

WebBrain是一款开源浏览器AI侧边栏助手,支持通过llama.cpp本地运行大语言模型,零成本、零隐私泄露。支持Chromium和Firefox浏览器,也可自带API密钥接入OpenAI、Claude等云端服务,实现本地与云端灵活切换。

NobodyWho是基于llama.cpp的开源端侧推理引擎,支持Swift、Kotlin、Flutter、React Native、Python和Godot多平台接入,提供工具调用、多模态、语音及GPU加速能力,让大语言模型完全在本地设备运行,无需API密钥。

8GB显存如何部署本地AI编程助手?本文分析显存瓶颈原因,推荐Qwen2.5-Coder-7B等适合的量化模型,并提供上下文长度设置、推理后端选择等实用优化技巧,帮你在消费级显卡上跑通Agent工具调用。

深度对比Qwen3-27B从1Bit到8Bit各量化档位的显存需求、推理速度与部署成本,帮你找到精度与预算的最佳平衡点。单卡4090跑4Bit每秒49字,本地部署成本仅为云端API的五十分之一。

深度评测Unsloth Desktop桌面客户端,涵盖本地大模型部署、推理加速、模型微调、多模态生成、Agent对接等核心功能,对比Ollama和LM Studio的差异化优势,附国内用户模型下载解决方案。
赚钱实战·第9期:本地大模型+开源工具的五条AI搞钱路
每周三分享至少5个用AI赚钱的实战思路,逻辑清晰可执行

JetBrains工具支持让Qwen大语言模型在Mac上本地部署更简单。本文解析本地LLM部署的隐私优势、成本考量,以及Apple Silicon芯片运行开源模型的工程化实践。

深入解析AI Agent开发的核心技术栈与实战路径,涵盖Agent工作原理、LangChain框架、MCP工具接入、多智能体协作等关键技术,附Vue项目自动创建实战案例与四阶段学习路线,助力程序员掌握智能体应用开发核心竞争力。