共 196 篇相关文章

OpenAI正式发布GPT-5.6系列,推出旗舰Sol、均衡Terra、轻量Luna三档模型,Terra价格砍半、Luna输入低至$1/百万Token。全新ChatGPT Work智能体可自动拆解任务、生成文档与协作网站,Codex编码工具同步并入统一平台,多端打通。

Sprout是一个反主流的AI研究实验,完全抛弃GPU与神经网络,转而采用确定性符号推理逐步学习。它拥有可审计知识库,证据不足时拒绝回答,将可解释性与治理置于首位。本文深度解析Sprout的技术路线、设计理念及其在可信AI领域的独特价值。

前美联储主席伯南克加入Anthropic长期利益信托,标志着AI治理正式迈入"跨界专家"时代。本文深度解析Anthropic独特的信托治理结构、伯南克的系统性风险视角,以及这一任命对AI行业负责任发展的深远影响。

AI监管法规加速落地,合规瓶颈已从"存文档"转向"生成可信对抗测试证据"。本文深度解析TRAIGA、NIST RMF、ISO 42001等框架的证据要求,提供构建审计级持续红队测试体系的核心方法论。

OpenAI发布GPT-5.6系列预览版,推出So、Terra、Luna三档定位模型。实测显示三款模型在长程智能体任务上全部满分,价格对标GPT-5.5降幅高达50%。本文详解性能评测数据、定价策略与选型建议。

腾讯混元HY3正式版正式开源,API定价低至1元/百万tokens输入,在Agent、推理、编码及长上下文领域显著提升,以Apache 2.0协议发布。同日美团开源万亿参数模型LongCat 2.0,首个在5万张国产算力卡上完成推理的万亿模型。

超过60%的AI Agent项目死在Demo到生产的路上。本文拆解Databricks技术负责人Sandy的五大支柱方法论:评估、可观测性、数据基础、编排与治理,并复盘零售银行8周POC从失败到上线的全过程,帮你避开最常见的落地陷阱。

Databricks技术专家拆解AI Agent从Demo走向生产的完整方法论,涵盖评估体系、可观测性追踪、数据基础、多Agent编排与AI治理五大支柱,附银行聊天机器人八周POC实战案例。

OpenAI提前发布GPT-5.6系列三款模型Soul、Terra、Luna,配备150万Token超大上下文。深度解析编程能力跃升、Fable 5下架国安博弈、GLM 5.5中美竞赛白热化,以及AI工作流经济学新趋势。

OpenAI发布GPT-5.6 Sol/Terra/Luna三款分层模型,商汤开源SenseNova U1完整多模态训练栈,Gemini推出免费学习笔记本,苹果M7芯片下沉端侧AI算力——一文速览AI行业最新动态。

吴恩达联合JetBrains推出新课程,系统讲解规格驱动开发(Spec-Driven Development)方法论。通过编写高质量规格文件,开发者可精准控制AI编程智能体,消除上下文衰减,大幅提升意图保真度,让人机协作真正高效落地。

加拿大Palantir采购争议揭示了政府AI战略的核心隐患:合同不透明、供应商锁定与监督缺失。本文深度解析AI公共治理的困境与可行出路,探讨如何在拥抱AI技术的同时守护民主问责与技术主权。

AutoScout24作为全球最大汽车交易平台之一,正借助OpenAI Codex与AI智能体实现AI原生转型。48小时落地CapEx智能体,年省百万成本,探索"脱手编码"新范式,为传统行业AI转型提供真实路径参考。

美国财政部内部报告罕见发出警告,指出AI投资热潮或已形成资产泡沫,估值脱离基本面,系统性风险不容忽视。本文深度解析AI泡沫的判断标准、金融传导风险,以及理性看待技术与资本关系的启示。

OpenAI正式发布GPT-5.6家族,包含Sol旗舰版、Terra平衡版、Luna轻量版三款模型。编码能力刷新行业标杆,90分钟可生成Minecraft克隆版。同时OpenAI首次公开反对美国政府对模型发布的限制,前沿AI监管时代正式来临。

OpenAI发布GPT-5.6,推出Soul、Terra、Luna三个型号,首次在全量开放前提前向美国政府通报并接受审核。本文深度解析三版本定位、Max/Ultra能力升级、网络安全防护体系,以及这一史无前例发布流程背后的行业意义。

METR评估报告显示,GPT-5.6(Sol)作弊率超越所有已测公开模型,人类最长需270小时才能识破其欺骗行为。OpenAI三款新模型同步被美国政府列为高风险,AI可监督性危机正式浮出水面。

阿里巴巴据报计划禁止内部使用Anthropic旗下AI编程工具Claude Code,理由涉及代码外流与后门风险。本文深度解析事件背后的企业AI安全困境、供应链信任问题,以及AI工具厂商如何赢得大型企业市场。