共 92 篇相关文章

传统质量评分无法发现AI Agent工具调用路径的隐性退化。本文介绍将Agent安全回归纳入CI流水线的工程方法,通过冻结Prompt、模型配置、工具Schema和执行轨迹实现可复现的自动化安全检测。

AI Agent频繁出现删库、数据泄露等安全事故。Snyk提出Agentic Development Security三大安全防线:代码生成可信、供应链防护、行为治理,通过钩子机制和确定性护栏确保Agent安全自主运行。


Numbat是一个开源的AI Agent安全检测与响应工具,支持跨框架部署,提供Agent行为可见性和执行前拦截能力。本文详解其核心功能、设计哲学及在AgentSecOps领域的应用价值。

NanoClaw创始人David Boyd深度拆解企业级自主Agent核心工程设计:三重安全隔离模型(运行时隔离、凭证隔离、人类在环审批)、LLM Wiki记忆方案,以及从个人Agent到团队规模化落地的实战路径,为企业AI Agent部署提供务实参考。
每日AI新鲜事·07月02日晚间播报:AI编程Agent安全攻击
07月02日晚间播报 AI领域热点新闻速递,10条精选资讯
深度解读Anthropic开源754个结构化网络安全技能定义,覆盖26个安全领域,映射MITRE ATT&CK等5大框架,兼容20+AI平台,为AI Agent构建标准化安全能力图谱。

深度解析Hugging Face平台AI智能体安全事件,还原智能体活动轨迹,剖析安全防护失效原因,总结权限最小化、纵深防御等关键启示,为AI Agent开发者提供安全防护参考。

OpenTrade是一款面向Claude Code和Codex的开源交易框架,通过Robinhood MCP接口实现AI Agent自动股票交易。本文详解其核心功能、护栏机制、适用人群及风险提示。

深入解析LangChain三层生态架构(LangGraph、LangChain、DeepAgents),详解Guardrail护栏机制与HITL人机协同两大安全策略,帮助开发者构建安全可控的AI Agent智能体应用。

Gotcha是全球首个安卓端AI语音副驾开源项目,支持端侧运行保护隐私,内置100+原生设备工具,通过Samosa AIR引擎实现语音指令到设备操作的完整闭环,免费开源可定制扩展。

详解DeepSeek Harness安装配置、四种Agent预设模式、第三方模型接入及插件管理,附带个人博客和任务管理应用两个实战案例,手把手教你搭建插件化AI Agent。

深入解析DeepSeek Harness(DSH)的核心设计理念与架构特点。了解Agent=Model+Harness公式、Cordis插件系统、四种运行模式及Trajectory可追踪机制,帮助开发者快速上手模块化Agent开发。

Stripe以超70亿美元收购AI模型聚合平台OpenRouter,看中的是模型调用背后的支付与路由数据。本文解析这笔交易的战略意义,以及Anthropic营收暴涨、后Transformer架构等AI行业最新动向。

深度解析腾讯开源的AI-Infra-Guard全栈AI红队测试平台,涵盖Agent扫描、MCP协议扫描、LLM越狱评估等五大核心能力,助力企业构建AI系统安全防线。

Ballet将自然语言描述的工作流转化为确定性代码执行,配合审计日志、一键回滚、模拟模式等企业级功能,解决AI Agent结果不稳定的痛点,让运营团队实现可靠的业务自动化。

CLI-Anything是香港大学开源项目,通过将软件封装为CLI接口实现Agent-Native化,让AI Agent能直接调用各类工具。项目已获47k Stars,配套CLI-Hub生态,正在重新定义软件与AI Agent的连接方式。

深入解析AI Agent如何重塑漏洞挖掘流程,涵盖AI挖漏洞、代码审计、CTF解题三大实战场景,以及AI自身安全防护要点,为安全从业者提供AI+网络安全的完整学习路径。

OpenAI宣布GPT-5.6 Luna向免费用户开放无限对话,Kimi K3成为首个接入GitHub Copilot主线的国产大模型。同期Google发布WeatherNext气象预测模型,NVIDIA推进Physical AI基础设施建设。

深入解析Harness技术体系,了解它如何通过上下文工程、记忆管理、多智能体架构等六大核心能力,将大模型智能体从随机系统改造为可控的稳定系统,推动AI从Demo走向大规模应用。