共 39 篇相关文章

深入解析谷歌提出的Beyond Zero安全理念,探讨AI时代企业如何超越传统零信任模型,应对提示词注入、数据投毒等新型威胁,构建面向AI智能体的身份管理与持续监控体系。

深度剖析AI智能体越狱与逃逸事件背后的技术原因,包括提示词注入攻击、权限管控缺失和沙箱隔离失效等核心安全隐患,并探讨企业应如何构建多层防护体系来保障AI Agent安全运行。

OpenAI正式推出GPT Live全双工语音AI,支持同时听说、实时打断、双模型委派及语义级实时翻译。本文深度解析GPT Live的核心技术突破、实测能力与人机交互范式变革。

GPT-5.6正式向所有用户开放,推出Sol、Terra、Luna三档模型,支持四智能体并行工作。本文深度解读官方评测数据、API定价、安全机制与Ultra模式,帮你读懂这次发布的三条核心主线。

OpenAI发布GPT-5.6系列,旗舰Sol、均衡Terra、轻量Luna三款模型全面实测。智能体任务媲美顶级模型,定价最低$1/百万token,与Fable 5、Opus 4.8横向对比,选型建议一览。

政府如何评估前沿AI模型的安全性?本文深度解析当前AI安全治理的不透明问题,探讨评估主体、标准缺失与监管能力挑战,并提出走向透明治理的改进路径。

第三方AI Agent存在数据泄露、权限滥用等安全风险,工信部已发出警告。本文深入分析企业自研AI Agent的核心逻辑,涵盖数据不出内网、Skill模块化扩展、开源生态复用等实践路径,帮助企业构建自主可控的智能体平台。

探讨前沿AI模型强制第三方安全测试的必要性,分析网络安全、生物安全和自主性三大风险领域,解读AI监管从自愿承诺向强制审查的范式转变及其面临的挑战。

Anthropic悄然更新隐私政策,Claude聊天机器人在特定情况下可能要求用户提交护照或驾照验证身份。本文解析这一变化背后的监管压力、安全考量及对用户隐私的影响。

海外安全博主对DeepSeek进行系统性越狱测试,通过直接请求、变换措辞、不同提示策略等多种手段尝试突破安全防线。测试结果显示DeepSeek安全机制具备意图识别、一致性拦截和上下文感知能力,在防护与可用性之间取得良好平衡。

伊利诺伊州通过前沿AI安全法案SB 315,涵盖透明度、审计和事件报告三大核心要求。OpenAI公开背书支持,称其采取了深思熟虑的方法。美国州级AI立法正构建事实上的国家监管框架。
科技前沿DeepSeek TUI是一款用Rust编写的开源终端AI编程工具,专为DeepSeek API优化,被称为DeepSeek版Claude Code。本文还解读AI巨头合资公司模式、Sierra融资9.5亿美金、AWS Agent基础设施更新等行业动态。
科技前沿OpenAI发布Rosalind Biodefense生物防御计划,通过GPT-Rosalind向政府机构开放,利用AI加速病原体监测、疫苗研发和大流行病防备。深度解读这一计划的核心能力、部署策略及行业影响。
行业洞察OpenAI与Thrive Holdings合作推出基于Codex的Tax AI系统,具备错误追溯、自动改进和测试验证三步闭环自我进化能力。深度解析这一税务AI Agent如何从人类反馈中持续学习,以及对企业级AI应用的深远启示。
产品体验深度解析ChatGPT Enterprise工作区Agent的分层权限控制体系,涵盖Agent构建者的自然语言约束、管理员的应用级深度管控、Human-in-the-Loop确认机制,帮助企业平衡AI自动化效率与安全治理需求。
英国AI安全研究所评估GPT-5.5:网络安全能力比肩Claude Mythos
英国AI安全研究所(AISI)发布GPT-5.5网络安全能力评估报告,结果显示其漏洞发现能力与Claude Mythos相当,但GPT-5.5已公开可用。本文解读评估核心发现及其对AI安全治理的深远影响。
科技前沿英国AI安全研究所(AISI)发布GPT-5.5网络安全能力评估报告,结果显示其漏洞发现能力与Claude Mythos相当。关键区别在于GPT-5.5已面向公众开放,对AI安全治理提出更紧迫要求。
科技前沿英国AI安全研究所(AISI)发布GPT-5.5网络安全能力评估报告,结果显示其漏洞发现能力与Claude Mythos相当,但关键区别在于GPT-5.5已向公众开放。本文解读评估核心发现及对AI安全治理的影响。