共 4615 篇相关文章

Rocky是一款极简透明的开源编程智能体,核心Loop仅几百行Python代码,原生集成DeepSeek搜索与Research模式,内置SWE基准测试环境,适合学习Coding Agent原理、文献调研与可复现的Agent实验。
每日AI新鲜事·07月25日晚间版:Agent工作流全面爆发
2026年07月25日晚间版 AI新闻速递+热点深度讨论

一个递归式技术命题:能否构造「元Skill」将任意Skill自动转化为Dify工作流?本文从Loop架构的反例出发,深入剖析工作流确定性编排与Agent动态自主决策的根本分野,为AI应用架构选型提供清晰判断框架。

实测智谱推出的手机AI Agent应用:通过云手机方案绕开权限限制,支持自然语言指令驱动自动化操作。本文详解其核心机制、真实表现、预装应用限制及未来潜力,帮你判断是否值得尝鲜。

企业级AI大模型岗位要求已全面升级,从流式输出中断恢复、高并发承载、多租户隔离,到大模型网关、Langfuse可观测追踪与LLM评估平台,掌握这八大核心能力,助你从"会用工具"进阶为"工程化落地专家"。

DeTech Engineering Agent(DTAC)通过对话式交互自动生成西门子博途PLC程序,本文解析其使用流程、V90伺服控制实测案例,以及AI工业编程的技术价值与局限性。

OpenAI将Codex与ChatGPT整合为统一平台,同时发布SOUL、TERRA、LUNA三款新模型。本文深度解析计算机操控、循环工作流、多线程并行等Agent实战技巧,以及Sites建站功能升级与"智能体原生"战略布局。

Pinterest工程师如何构建Medic for Apache Spark——一款多智能体自动诊断工具,从单一ReAct Agent到多智能体架构的演进历程,涵盖可观测性、日志降噪、端到端测试等关键工程经验。

深入解析企业级Agent与玩具Demo的本质差距,涵盖长周期自主运行、人机安全审批(HITL)、事件溯源三大核心能力,结合内容运营与SRE智能运维两套商用项目实战,帮助开发者掌握可复用的Agent工程化架构。

NanoClaw创始人David Boyd深度拆解企业级自主Agent核心工程设计:三重安全隔离模型(运行时隔离、凭证隔离、人类在环审批)、LLM Wiki记忆方案,以及从个人Agent到团队规模化落地的实战路径,为企业AI Agent部署提供务实参考。

深度解析基于FastAPI+Vue3的AI论文写作系统,涵盖多Agent协作架构、RAG检索增强生成、流式输出等核心技术,从选题到润色实现学术写作全流程自动化,适合AI应用开发者学习参考。

Office CLI是登上GitHub Trending的开源工具,让AI Agent直接创建Word、Excel、PowerPoint文件,支持渲染预览与自动检查,无需安装Microsoft Office,真正打通AI办公自动化的最后一环。

深度解析AI Agent测试的五大核心维度:命令安全性、工具调用准确性、任务规划合理性、输出一致性、错误自我修复。掌握自动化测试脚本方法,了解测试工程师转型Agent测试的必备技能与实战路径。

记录开发者用Fan Browser Agent全自动申请韩国旅游签证的真实过程:自主理解申请流程、高速填写30余项表单、处理文件上传报错,直观展示浏览器Agent在复杂网页任务中的实际能力边界。

深度解析GTM Agent三层架构——信号层、买家智能层与行动层,揭示如何通过上下文图谱识别匿名访客、捕获购买意图,帮助B2B销售团队在买家进站第一时间完成精准识别与个性化触达,避免AI"打补丁"式的失败陷阱。

系统解析AI时代自动化测试的三大主流方案:AI编程生成代码脚本、Agent直接执行测试用例、Skill技能封装复用。帮助测试工程师理解大模型如何重塑测试范式,构建可落地的AI测试工作流。

LangChain、CrewAI、AutoGen怎么学?本文对比DeepLearning.AI、DataCamp等主流Agentic AI课程,为有工程背景的开发者提供项目驱动的实战学习路径,帮你快速掌握AI Agent开发核心技能。
Ego-lite:专为人与AI Agent并行工作设计的开源浏览器
ego-lite 是 citrolabs 团队推出的开源 AI 原生浏览器,支持人类用户与 AI Agent 在同一环境中并行工作。本文深入解析其设计理念、并行协作模式及对开发者的实际价值。

Grok 4.5正式发布,1.5万亿参数、50万上下文窗口,编程实战成本仅为竞品十分之一。本文深度解析其核心能力、Cursor训练数据优势、性能实测数据,以及马斯克体系数据飞轮的战略逻辑。

当AI Agent执行退款、转账等高危操作时,如何引入可靠的人工审批?本文深度拆解Human-in-the-loop机制的核心痛点,分析现有方案的不足,并给出成熟审批层应具备的三大特性:可达性、低摩擦与不可篡改审计日志。