共 11 篇相关文章

政府如何评估前沿AI模型的安全性?本文深度解析当前AI安全治理的不透明问题,探讨评估主体、标准缺失与监管能力挑战,并提出走向透明治理的改进路径。

深度解析GLM-5.3模型的前沿编码能力与涌现网络安全能力,探讨其在软件工程、漏洞发现、安全审计等领域的应用潜力,以及社区对安全治理与滥用风险的讨论。

HeyZoku是一款Mac端语音优先的代理式开发环境,支持同时运行10个编程代理,通过语音呼名即可指挥Claude、Codex、Cursor等AI助手。本文详解其本地语音识别、自带订阅、一次性付费三大核心特性及实际使用场景。

深度解析Fable 5与GPT-5.6 Sol的性能基准对比:Terminal Bench、HealthBench、ExploitBench全维度拆解,揭示定价策略差异、OpenAI政府股权争议,以及AI行业权力格局的深层演变。

知名AI越狱研究者Pliny the Liberator一条反讽推文,折射出开源权重模型安全隐患、AI监管错位与超级智能叙事泡沫等核心议题。本文逐层拆解其背后的AI安全与开源治理真问题。

深度解析Claude Code泄漏源码的架构设计,涵盖TypeScript技术栈选择、Harness线束架构的七大核心机制、工具调用管理与上下文优化等关键设计,为AI Agent开发者提供系统性参考。

AI不只是聊天窗口。本文详解AI的三种使用形态:Chatbox聊天问答、Cowork协同办公、CLI命令行工具,并给出Claude、Codex、Kimi、DeepSeek四款产品的选择建议与实际组合方案。
英国AI安全研究所评估GPT-5.5:网络安全能力比肩Claude Mythos
英国AI安全研究所(AISI)发布GPT-5.5网络安全能力评估报告,结果显示其漏洞发现能力与Claude Mythos相当,但GPT-5.5已公开可用。本文解读评估核心发现及其对AI安全治理的深远影响。
科技前沿英国AI安全研究所(AISI)发布GPT-5.5网络安全能力评估报告,结果显示其漏洞发现能力与Claude Mythos相当,但因已向公众开放使用,引发AI安全治理新挑战。本文深入解读评估发现与行业影响。
英国AI安全研究所评估GPT-5.5网络安全能力
科技前沿OpenAI前CTO穆拉蒂在马斯克诉奥特曼案中宣誓作证,指控奥特曼在AI模型安全审查问题上撒谎,绕过内部安全流程。这一证词揭示了OpenAI内部在安全标准执行上的深层信任危机,对AI行业治理产生深远影响。