共 161 篇相关文章

跨站提示注入正成为Web智能体最棘手的安全威胁。本文深度解析Prismata项目的"限制式防御"思路——通过上下文隔离、权限边界与可信度分级,将提示注入的破坏范围控制在沙箱之内,为AI智能体安全防护提供新范式。

Hacker News上一则关于Anthropic对用户执行"提示注入"的帖子引发AI社区热议。本文深度解析提示注入的技术本质、系统提示的行业惯例,以及AI厂商在产品控制与用户知情权之间如何寻求平衡。
科技前沿安全机构Prompt Armor披露微软Copilot Cowork存在严重数据泄露漏洞,攻击者通过提示注入利用AI代理的邮件权限和外部图片渲染机制窃取OneDrive文件。本文深入分析攻击链原理及AI代理安全的"致命三角"问题。

深入分析开源权重模型的核心争论:模型权重公开发布带来透明度与创新,但也引发安全滥用风险。本文探讨分级发布、红队测试等折中方案,解读开源AI背后的行业博弈与治理挑战。

深入分析LLM智能体长期记忆的安全威胁,解析记忆投毒的持久性、状态性和传播性特征,介绍六阶段生命周期防御框架及可验证记忆治理方案,帮助团队构建可信AI系统。

一位大学教授在作业中嵌入隐形提示词,成功识别出35名学生中32人使用AI作弊。本文详解这种隐形提示陷阱的技术原理、为何比传统AI检测工具更有效,以及它对教育评估体系带来的深层挑战。

深度拆解AI Agent架构的五个进化阶段:模型调用、工具调用、工作流、Agent循环与生产运行时。掌握Prompt、Workflow与Agent的职责边界,了解生产级Agent系统的核心设计原则与选型策略。

实测LibTV的AI Agent功能,从脚本对话到分镜生成、视频合成,一个人一天完成动画短片制作。详解Skill库、节点工作流、故事版模式等核心功能,看AI如何重塑动画创作流程。

上下文工程是构建高效AI Agent的核心方法论,涵盖查询增强、RAG检索、提示设计、记忆管理与工具调用五大模块。掌握Write、Select、Compress、Isolate四个核心动作,从根源解决大语言模型幻觉问题。

深入解析 Claude Code 的核心优势与使用方法,对比终端 Agent 与设备 Agent 的区别,手把手教你搭建 Claude Code + DeepSeek 开发环境,适合个人开发者与企业团队参考。

通义千问发布第三代图像生成模型Qwen-Image 3.0,支持4.5K Token长指令、10px文本渲染与12种语言排版,瞄准海报、信息图等可直接交付场景。同期速览:Anthropic版权和解、Grok接入Excel、腾讯HRAP 1.0等AI最新动态。

从LLM自动补全本质、Token与上下文窗口,到RAG向量数据库、MCP协议,再到AI智能体循环设计——本文用生动比喻拆解AI工程现实,帮助产品经理、开发者和初学者建立完整的AI技术认知框架。

Anthropic工程师深度揭秘Claude Code一年半演进历程:系统提示词缩减80%、65%的PR由AI自动落地、Claude Tag多人协作实践,以及auto模式安全机制的构建逻辑。
微软AI编程双线布局:Claude Code与GitHub Copilot …
微软计划推出Claude Code与GitHub Copilot CLI,将命令行终端打造为AI编程新入口。本文深度解析微软多模型策略、CLI工具优势,以及这一布局对开发者工作流的实质影响。
跨平台MicroVM沙箱:让AI代码在隔离环境安全运行
深入解析跨平台MicroVM沙箱技术:支持Windows/Mac/Linux三大系统,内置策略引擎实现细粒度访问控制。探讨MicroVM与容器的区别、AI Agent安全执行环境搭建,以及多租户代码隔离方案。

企业部署AI Agent时,过度审批导致效率归零,放任不管又风险失控。本文从可逆性、影响范围、数据流向、阈值分级等维度,提供一套可落地的Human-in-the-Loop判断框架,帮助团队在安全与效率之间找到平衡。
Prompt中一个词如何左右AI输出:可能性之井原理解析
提示词中的单个词汇如何影响大语言模型的输出?本文深度解析LLM自回归生成机制与概率偏移原理,提供避免引导性提问的实用技巧,帮助你掌握Prompt Engineering核心思维。
Clawk:为AI编程助手创建用完即弃的Linux沙箱隔离环境
AI编程助手(Claude Code、Cursor等)直接运行于本地机器存在严重安全隐患。Clawk项目提出核心解决方案:为AI智能体提供一次性disposable Linux虚拟机,彻底隔离SSH密钥、API令牌等敏感数据,构建更安全的AI编程工作流。