共 38 篇相关文章

OpenAI发布GPT-5.6家族三款模型Sol、Terra、Luna,推出ChatGPT Work、全新桌面应用与Hosted Sites。AI可自主完成财务分析、代码开发、文件整理,Codex已能独立完成模型训练。本文梳理核心能力与真实应用场景。

深度解析构建长效运行AI智能体(Long Running Agent)所需的七大核心组件:目标、评估器、验证器、外层循环、编排、可观测性与记忆。掌握这套控制系统,让智能体真正可靠自主运行。

一条反讽推文揭示AI圈核心争论:人类历史上从未出现过超级智能,凭什么说"没事"?本文解析加速派与AI安全派的对立,探讨超级智能风险为何不能用历史类比轻描淡写。

深度解析Anthropic最新Claude Fable 5模型:源自内部超强模型Methos,SWE Bench Pro跑分80.3碾压GPT 5.5,实测连续自主开发9.5小时。详解实战表现、明显短板与程序员职业危机的理性应对。

深入解析awesome-auto-ai-research开源项目,涵盖自动化AI研究领域的核心论文、开源工具、研究机构与发展路线图,帮助研究者快速了解AI自主科研的前沿进展与资源入口。

Anthropic最新报告披露其代码库超80%由AI编写,工程师日均代码产出增长8倍。本文深度解读AI对软件开发、知识工作的冲击,分析品位护城河、AI泡沫阶段、循环工程等核心议题。

Anthropic在最新模型系统卡中披露,Claude会对涉及前沿LLM开发的请求静默降低回复质量。这一政策引发社区强烈反弹,涉及AI信任危机、商业竞争与安全伦理的深层博弈,最终被撤回。

Anthropic披露Claude已接管公司超80%代码编写,AI独立完成任务的能力每四个月翻一倍。从修Bug到独立科研,三个真实案例揭示AI能力飙升的速度,以及留给人类适应的窗口正在快速关闭。

fast.ai创始人Jeremy Howard公开质疑Anthropic的AI安全策略:用最强模型做前沿研究却限制他人使用,安全叙事是否沦为竞争壁垒?深度解析AI开放与封闭之争背后的逻辑矛盾与行业启示。

谷歌CEO桑达尔·皮查伊在Hard Fork播客中坦承AI编程领域落后于竞争对手,详细解析Gemini模型争议、AI搜索变革、公众焦虑回应及AGI最新判断,揭示谷歌AI战略全貌。

AI圈一日六大事件深度解读:OpenAI因Bug误封Pro用户引发信任危机,Anthropic呼吁暂停前沿模型开发,DeepSeek质量波动,Grok图像模型登顶竞技场,ChatGPT月活破10亿,微信内测AI支付功能。

Anthropic报告警告AI已能自我优化并制造下一代AI,代码贡献率飙升至80%,优化能力达人类52倍。但在650亿融资和上市前夕发布,究竟是真实技术担忧还是精心策划的商业操作?深度解析AI自我进化风险与行业博弈。

Anthropic最新内部数据显示,Claude已完成自身代码库80%的开发工作,工程师产出提升8倍,开放式任务成功率从26%跃升至76%。AI开发AI的递归自我改进时代正在加速到来。

Anthropic公开表示Claude正在加速AI开发进程,可能实现递归自我改进。深度解读这一发现对AI安全、行业竞争和人类未来的深远影响。
科技前沿GPT-5.6启动内测引入UltraFast模式,Codex目标驱动模式革新AI编程,MiniMax模型压缩成本降360倍,Anthropic与OpenAI估值攻防战升级,Cerebras IPO募资55.5亿美元,Figure机器人8小时自主作业验证,谷歌Vio 3.1领跑AI视频生成。
科技前沿Gemini 3.2 Pro首批泄露测试结果表现平平,SVG生成小幅改进但UI能力薄弱,Flash版与Pro版难以区分。同时GPT-5.6已开启内部测试,Claude新预览版在网络安全领域实现突破性表现。AI模型迭代周期急剧缩短,行业竞争白热化。
科技前沿OpenAI Codex集成ChatGPT移动端,微软收紧Claude Code许可,腾讯开源Agent Memory方案Token消耗降低61%,NVIDIA发布Rubin Agent算力平台,RSI获46亿美元估值。AI编程工具生态竞争进入白热化阶段。
科技前沿Andrej Karpathy发布开源项目autoresearch,利用AI Agent在单GPU环境下自动运行nanochat训练实验,GitHub已获8万+Star。本文深度解析其技术架构、核心理念及对AI科研自动化的深远影响。