共 110 篇相关文章

深度解析新一代大模型多智能体协作能力:从动态网页端到端生成,到Excel数据表格自动构建,探讨AI如何从聊天问答升级为真正的任务交付工具,以及Agent能力评测趋势。

通义千问Qwen 3.8 Max拥有2.4万亿参数,即将开源。KingBench实测综合得分81.25%,位列排行榜第二,超越Claude Opus 4.8,仅次于Fable 5。本文详解8道测试题表现、真实使用体验与短板分析。

阿里通义千问Qwen3最强版本实测:2.4万亿参数开源大模型在KingBench综合评测中以81.25%高分排名第二,超越Claude Opus 4.8,在游戏开发、数学推理、智能体任务三项满分。预览版已可通过Token套餐免费使用。

Juggler是一款面向硬核程序员的开源AI编程代理工具,将LLM上下文视为可编辑文档,支持深度检查与快速导航,提供本地、远程、多客户端灵活部署,让开发者彻底告别黑箱式AI助手。

深入解析LangChain生态四大核心模块:LangChain基础组件、LangGraph流程编排、Deep Agents自主规划与LangSmith运维平台。从Hello World到实战搭建Agent,掌握工具调用、提示词模板与记忆管理,理解AI Agent开发的核心构建思路。

OpenAI正式将Codex并入ChatGPT,同步推出GPT-5.6模型。从主动规划任务、跨设备协同执行,到定时推送选题清单,本文深度解析这次整合如何让AI助手从被动问答进化为真正的"超级助理"。

想系统学习AI Agent开发?本文深度解析一本涵盖Agent组件架构、RAG记忆管理、多智能体协作、Function Calling及可观测性的实战书籍,帮你从零构建可落地的智能体系统。

B站UP主自研学术智能体Modox迎来重磅更新,新增HTML流程图生成、软著文档支持、Word格式稳定性加强及一键生成Web全站应用四大核心能力,从学术写作走向通用AI写作工具。
百行Lisp实现AI Agent:极简代码揭示智能体本质
一个仅100行Lisp代码实现的AI Agent项目,揭示了ReAct循环的本质逻辑。本文深度解析Agent核心结构、Lisp语言的独特优势,以及极简主义工程哲学对AI开发者的启示。

Reddit用户用一句话指令测试GPT-5.6 Sol,模型在Row-Bot框架下5分钟完成3D伦敦交互网站,涵盖浏览器验证与视觉分析闭环。本文深度解析AI编程Agent从代码生成到自主工程的三层能力跃迁。

Google Labs开源stitch-skills项目,为AI Agent提供标准化技能封装方案,兼容Gemini CLI、Claude Code、Cursor等主流编程Agent。本文深入解析Agent Skills开放标准的架构设计与开发者价值。

腾讯云开源TencentDB Agent Memory,采用四层渐进式记忆管道,为AI Agent提供完全本地化的长期记忆能力,零外部API依赖,已获超8100个GitHub Star。适合金融、医疗等高隐私需求场景,TypeScript编写,轻松集成现有Agent应用。

有十年经验的Java、后端开发者如何转型AI?本文深度解析为什么智能体(Agent)方向最适合传统开发者——技能可复用、市场机会大,并分享从「会用框架」到「深入源码」的实战转型路径。

AI编程能力重大突破!实测案例显示,新一代大模型可在90分钟内生成《我的世界》克隆版,30分钟复刻忍者神龟游戏,并一次性完成3D场景、动画、碰撞检测与游戏逻辑的协同开发。本文深度解析AI从辅助编程工具迈向独立项目开发者的关键趋势。

基于Spring AI Alibaba Graph构建HR招聘全流程Workflow Agent,涵盖简历解析、岗位匹配评分、分级出题、人工介入断点续传、时间旅行状态回滚等20个核心技术点,助力Java开发者快速落地企业级AI Agent应用。

Fortress是一款开源隐身版Chromium,专为AI Agent设计,通过抹平自动化浏览器指纹特征,帮助开发者绕过Cloudflare等反爬系统。本文深度解析其技术原理、适用场景与合规边界。

深度解析为何TypeScript成为AI Agent开发首选语言:涵盖Zod结构化输出校验、LangGraph图状态机底层设计思路拆解,以及前端开发者转型全栈AI的完整学习路径,帮你在AI工程化浪潮中建立真正的技术壁垒。

OpenAI发布GPT-5.6系列,含Soul、Terra、Luna三款模型。Terminal Bench编程评测排名第一,Ultra模式将智能体编排原生化,同时揭示Agentic Trace数据成为下一代AI训练的核心竞争力。

Vercel首席软件官Andrew Qu深度阐述内部Agent框架eve的设计理念,涵盖Skills模块化、Sandboxes沙箱安全机制与Agent可读网站三大核心支柱,揭示AI Agent从"指令驱动"到"目标驱动"的软件范式转变。

AIVenture是Google团队推出的开源复古地牢游戏,将Vibe Coding、智能体工作流、工具调用等AI工程概念融入可玩关卡。基于Angular、Phaser.js与Gemma模型构建,支持本地与云端灵活部署,是开发者学习生成式AI应用开发的实践利器。