共 59 篇相关文章

安全研究人员披露GitLost攻击手法,通过提示注入(Prompt Injection)诱骗GitHub AI代理泄露私有仓库源代码。本文深度解析攻击原理、AI代理安全隐患及开发者防御建议。

LangChain推出的LangSmith Engine是一个专门用于追踪Agent失败、优先级排序并自动起草修复方案的智能体工具。本文深入解析其三大核心能力、沙箱隔离与子Agent架构设计,以及持续运行Agent评测的行业难题。

agentskills开源项目正试图解决AI Agent生态碎片化问题,通过标准化技能规范实现技能的可移植、可组合与可复用。本文深入解析Agent Skills的设计思路、核心价值及其对AI智能体生态的深远意义。

OpenAI推出GPT-5.6 Sol,定价仅为Anthropic Fable 5的一半。本文通过系统卡硬数据对比两款模型在HealthBench、网络安全等基准上的表现,深度解析Sol的性价比优势、Fable的安全代价,以及AI权力格局的最新走向。

阿里巴巴据报计划禁止内部使用Anthropic旗下AI编程工具Claude Code,理由涉及代码外流与后门风险。本文深度解析事件背后的企业AI安全困境、供应链信任问题,以及AI工具厂商如何赢得大型企业市场。

盘点12个GitHub高热度开源AI智能体项目,涵盖视频生成、智能体框架、技能包(Skills)、代码理解引擎、安全扫描与语音处理,助你快速搭建可用的AI Agent工作流。

Hacker News上一则关于Anthropic对用户执行"提示注入"的帖子引发AI社区热议。本文深度解析提示注入的技术本质、系统提示的行业惯例,以及AI厂商在产品控制与用户知情权之间如何寻求平衡。

第三方AI Agent存在数据泄露、权限滥用等安全风险,工信部已发出警告。本文深入分析企业自研AI Agent的核心逻辑,涵盖数据不出内网、Skill模块化扩展、开源生态复用等实践路径,帮助企业构建自主可控的智能体平台。

深入解析Agent Loop(智能体循环)的运行原理:从思考到行动的循环机制、智能体与大模型的本质区别、终止条件判断,帮助开发者掌握AI Agent框架的底层逻辑与设计思维。

Anthropic推出Sonnet 5编排模型,面向Pro和Max订阅用户开放。作为Computer Use场景的核心调度引擎,Sonnet 5专为多步骤任务执行、工具调用与AI Agent自动化工作流设计,标志着Claude系列向智能体AI方向的重要演进。

深度对比E2B、Daytona、Modal、Cloudflare Sandbox、Vercel Sandbox五大AI Agent代码执行沙箱方案,从隔离性、冷启动延迟、状态管理、定价模式四个维度帮你找到最适合的选择。

深入解析Arcade MCP运行时如何为AI Agent提供安全授权层,对比自建OAuth方案的优劣,分析适用场景与技术架构,帮助开发者构建生产级Agent系统。

OpenAI董事会成员Zico Kolter与Gray Swan CEO Matt Fredrikson深度解读AI安全与网络安全的本质区别,阐述红队测试从手工艺到工程学科的演进路径,以及系统化对抗性评估的核心方法论。

6月20日AI早报:OpenAI Codex支持本地与远程主机交接会话,Claude Code修复3%用户额度Bug,AlphaFold负责人John Jumper离开DeepMind加入Anthropic,欧盟押注4000亿参数开源模型,Cloudflare推出AI Agent临时账户功能。

AI代理自动审查机制全面上线,分类器子代理以97%准确率对每个操作进行三级安全决策。深入解析其工作原理、上下文感知技术、误判边界及对AI代理安全范式的深远影响。
科技前沿安全机构Prompt Armor披露微软Copilot Cowork存在严重数据泄露漏洞,攻击者通过提示注入利用AI代理的邮件权限和外部图片渲染机制窃取OneDrive文件。本文深入分析攻击链原理及AI代理安全的"致命三角"问题。
产品体验Fabraix是一款由前Meta工程师打造的AI Agent对抗性测试工具,通过1000+自适应攻击策略,以纯黑盒方式零集成发现Agent的幻觉、安全漏洞和逻辑错误,帮助开发者在用户之前定位问题。
科技前沿Anthropic正式公开HackerOne漏洞赏金计划,任何安全研究者均可提交Claude模型漏洞报告并获得奖励。本文解读这一转变对AI安全行业的深远影响,以及白帽黑客如何参与AI安全防护。