共 70 篇相关文章

agentskills开源项目正试图解决AI Agent生态碎片化问题,通过标准化技能规范实现技能的可移植、可组合与可复用。本文深入解析Agent Skills的设计思路、核心价值及其对AI智能体生态的深远意义。

拨开Agentic AI炒作迷雾,看清智能体应用的真实价值。基于吴恩达课程精华,揭示顶级开发者与普通开发者的真正差距——不在于框架选型,而在于系统性评估(Evals)与错误分析能力。附真实落地场景与开发方法论。

智谱AI发布第五代大模型GLM 5.2,MIT协议完全开源可商用。Code V3评测全球第三、96分S级,开源模型排名第一;百万Token上下文真实可用,长程任务稳定不掉链。本文从编码能力、上下文可靠性、MoE架构及现实短板四维度全面拆解。

月之暗面开源Kimi K2.7 Code编程模型,Token消耗降低30%;HiDream O1 Image 1.5在国际权威榜单超越Google与字节跳动,登顶中国模型第一。一文梳理国产大模型最新突破与AI代理工具链进展。

UP主阿江用Codex跑了100亿Token,完成cc-haha项目从Tauri 2迁移至Electron的架构重构。本文深度解析Codex的长程工程能力、Computer Use功能、订阅成本对比,以及给普通开发者的三条实用建议。

Vibe Coding(氛围编程)让零基础用户通过自然语言驱动AI完成开发。本文详解Claude Code核心工具、DeepSeek等模型选型与成本控制技巧、智能体工程方法论,助你快速上手AI编程。

球迷必看!基于AIPC本地算力的「爱看球Agent」实测体验:自动预约直播、后台录制分析、智能提取高光片段,几分钟看完整场比赛精华。深度解析本地AI处理方案如何颠覆传统观赛方式。

深入解析LangChain框架中Model与Agent的核心关系,涵盖模型统一接口、智能体工具调用、中间件机制等关键概念,帮助零基础开发者快速建立大模型应用开发的系统认知。

深入解析Agent Loop(智能体循环)的运行原理:从思考到行动的循环机制、智能体与大模型的本质区别、终止条件判断,帮助开发者掌握AI Agent框架的底层逻辑与设计思维。

深度实测智谱AI GLM4开源旗舰模型,在Design Arena榜单排名第一,前端开发超越Claude 3.5和Gemini。详细对比落地页生成、Spotify复刻、3D游戏开发等场景表现,成本仅为Claude Opus的六分之一。

深度解析Anthropic最新Claude Fable 5模型:源自内部超强模型Methos,SWE Bench Pro跑分80.3碾压GPT 5.5,实测连续自主开发9.5小时。详解实战表现、明显短板与程序员职业危机的理性应对。

深度解析阿里通义实验室AgentScope 2.0多智能体框架的六大核心升级,包括事件系统、安全拦截、人工介入、工作区系统等生产级特性,以及ReAct与Plan-and-Execute两大智能体设计模式的原理对比。

深度解析Qwen3.6两款社区衍生模型:27B扩展至34B 80层提升推理与蒸馏能力,35B MoE压缩至14B实现8GB显卡本地部署。涵盖REAP剪枝策略、MoE专家冗余现象及选择建议。

深度实测智谱GLM 5.2模型与Zcode编程工具,涵盖界面体验、编码基准测试、长程Agent性能对比。每天500万Token免费额度,开源MIT许可,与GPT、Opus横向对比分析其真实实力与不足。

Planning with Files 是GitHub热门开源项目,通过Test_Plan、Findings、Progress三个Markdown文件配合Hooks机制,解决Claude Code、Cursor等AI编程工具在长任务中丢失上下文的问题,让AI编程助手的工作记忆持久化。

深入解析Qwen3-Coder模型的核心能力:11小时连续运行、1万行代码生成、1000+次调用。详解其长程Agent循环架构、推理上下文持久化、思考模式切换等关键技术,以及在Fireworks平台上的部署实践与成本分析。

实测Kimi K2.7接入Hermes Agent智能体系统,展示一句话生成3D游戏、网页操作系统等完整应用的全流程,对比Claude 3.5基准测试数据,解析智能体团队协作与自纠错机制。

通过SVG绘制、3D游戏生成、电梯调度模拟和真实Bug修复四大实战场景,横向对比Claude Opus 4.8、GPT 5.5、MiniMax M3、DeepSeek V4 Pro和Mimo 2.5 Pro的代码能力,用完成度说话。