共 12 篇相关文章
社区热议·第2期:AI安全监管与社区焦虑
每周四聊聊Twitter和Reddit上本周最火的AI话题
国会致信奥特曼:要求公开HuggingFace安全事件真相
美国国会正式致函OpenAI CEO Sam Altman,要求就HuggingFace平台安全事件提供透明度说明。本文分析国会核心诉求、AI供应链安全挑战及对行业的深远影响。
英国AI安全研究所安全事件报告解析:透明治理的标杆意义
解析英国AI安全研究所公开的安全事件报告,探讨AI安全事件披露的行业意义、监管机构面临的安全挑战,以及建立统一AI安全事件响应标准的紧迫性。

Anthropic主动披露其AI模型Claude被恶意利用发起自动化网络攻击,本文详解攻击手法、行业影响及企业应对策略,深度分析AI安全护栏的局限性与未来挑战。

OpenAI发布GPT-5.6预览版,旗舰Soul、均衡Tara、轻量Luna三款模型同步亮相。本文基于KingBench 3真实测评,详解各模型在数学、前端、智能体任务上的表现,并与Anthropic Fable进行横向对比,助你快速选型。

第三方AI Agent存在数据泄露、权限滥用等安全风险,工信部已发出警告。本文深入分析企业自研AI Agent的核心逻辑,涵盖数据不出内网、Skill模块化扩展、开源生态复用等实践路径,帮助企业构建自主可控的智能体平台。

OpenAI董事会成员Zico Kolter与Gray Swan CEO Matt Fredrikson深度解读AI安全与网络安全的本质区别,阐述红队测试从手工艺到工程学科的演进路径,以及系统化对抗性评估的核心方法论。

海外安全博主对DeepSeek进行系统性越狱测试,通过直接请求、变换措辞、不同提示策略等多种手段尝试突破安全防线。测试结果显示DeepSeek安全机制具备意图识别、一致性拦截和上下文感知能力,在防护与可用性之间取得良好平衡。

OpenAI发布公开声明阐述其AI政策立场与倡导方式。本文深入分析OpenAI选择透明化的核心逻辑、科技公司政策倡导面临的争议与挑战,以及对AI行业监管生态的深远启示。

伊利诺伊州通过前沿AI安全法案SB 315,涵盖透明度、审计和事件报告三大核心要求。OpenAI公开背书支持,称其采取了深思熟虑的方法。美国州级AI立法正构建事实上的国家监管框架。

Claude Mythos 5模型短暂现身Anthropic API引发发布猜测,OpenAI与美国政府就股权转让及公共财富基金进行超一年谈判,Hermes Agent V0.16.0发布支持中文桌面应用。
科技前沿谷歌招聘流程引入Gemini AI助手考核应聘者AI应用能力,OpenAI推出GPT-5.5 Cyber专攻关键基础设施防御,Anthropic估值逼近万亿美元。Mozilla用AI两月修复271个Firefox漏洞,LanVM 3B开源模型精确控制超越闭源巨头,AMD发布MI350P显卡。