大佬观点·第4期:OpenAI一周连发七条推文,从自我优化到AI减速机制
大佬观点·第4期:OpenAI一周连发七条推文,从自我优化到AI减速机制
每周五盘点本周行业大佬的发言和官方公告
每周五盘点本周行业大佬的发言和官方公告
李博,这周我刷推特刷到有点上头。OpenAI一家就发了七八条重要动态。
我也注意到了。这周基本就是OpenAI的独角戏,官方账号火力全开。
而且不是一个调调。有炫技的、有认怂的、还有讲安全的。特别分裂。
所以今天咱们就顺着OpenAI这条线捋一遍。看看官方到底想传递什么信号。
那先说热度最高那条。OpenAI官方推特,一万七千赞。说GPT-5.6 Sol拿来优化自己了?
对,原文很有意思。部署之后,他们用Sol去推进效率前沿——让它自己跑得更省。
具体数字呢?我记得他们列了两条。
GPU内核优化省了百分之二十的服务成本,投机解码改进带来百分之十五以上的token生成效率。
等等。这不就是AI在优化AI自己吗?听起来有点科幻。
先别激动,小雨。这不是自我进化,是模型帮工程师写底层kernel代码。
所以本质还是个高级编程助手,只是任务对象是它自己的基础设施?
对。但信号很明确——现在拼的不是聪明,是省钱。降本这件事被官方摆到台面上了。
这跟最近说的可用性才是留客关键,是不是一个逻辑?
完全一致。你看DeepSeek这周还宣布涨价呢。大家都在为推理成本发愁。
OpenAI这条就像在说:我不涨价,我让模型自己把成本压下去。
这个解读到位。这是一种姿态。省下来的算力还能反哺前沿研发。
但同一周他们也有认怂的。那条ARC-AGI-3的推,我看着都替它尴尬。
对,九千多赞。说Sol能解数学开放难题,却在2D拼图游戏基准上抓瞎。
这反差太大了吧。数学都会做,玩个拼图不行?
他们查了原因——harness不让模型记住学到的东西。调了两个API设置就翻盘了。
翻盘到什么程度?
分数三倍,输出token还少了六倍。所以问题不在模型,在评测的工具链。
这就有意思了。原来跑分低不一定是模型菜,可能是姿势不对。
这也印证了最近那个观点——评测不能只看总分,得看场景和配置。
但李博,我觉得最耐人寻味的是那条讲减速的。你怎么看?
那条是重头戏。OpenAI说未来某个时刻,AI加速可能高到全世界需要给它踩刹车。
OpenAI自己说要减速?这不是自打嘴巴吗?
妙就妙在这。他们还说希望配合美国政府,联合其他实验室和开源社区做工具和机制。
这话放在EU AI Act刚全面生效的节点,感觉不是巧合。
绝对不是巧合。这是一次姿态管理——主动谈减速,等于抢占安全叙事的话语权。
而且它把政府拉进来了。这跟Anthropic一贯的安全人设是不是撞车了?
对。以前谈刹车是Dario的地盘,现在Sam也来站这块地了。安全成了标配话术。
配套的还有几条落地的。心理健康那条,跟美国心理学会合作。
对,还有开源的Codex Security CLI,扫代码库、验证修复、接CI/CD。
有意思的是这条还是Hacker News先扒出来的,官方后知后觉。
外加两起外部安全评估事件的复盘。你把这几条连起来看——全是安全牌。
所以这周OpenAI的主线其实是:一手省成本,一手立安全人设?
总结得漂亮。降本是给投资人和用户看,安全是给监管和舆论看。两条腿走路。
那对我们普通用户,最实在的影响是啥?
最实在的是Plus和Pro那个推理力度滑块。以后自己拖着调,简单任务省钱,难题拉满。
这个我喜欢。把成本控制权交给用户,也算是降本思路的延伸。
对。整周看下来,2026下半年的关键词就俩:效率和可信。谁占住谁赢。
行,这期就聊到这。下期咱们蹲一下Anthropic会不会接招回应减速这个话题。
相关推荐
科技前沿GLM-5.2登顶全球开源模型榜首:前端编码能力领跑业界
智谱AI发布GLM-5.2模型,在Artificial Analysis Intelligence Index评测中登顶全球开放权重模型榜首,同时被评为顶级前端编码模型。深入解析GLM-5.2的突破性表现与开源模型竞争格局变化。
科技前沿AI行业罕见平静日:递归自我改进暗流涌动
AI领域迎来罕见的平静一天,多个资讯源集体沉默。但平静背后,递归自我改进(RSI)研究仍在持续推进。解读AI行业发展节奏与从业者应对策略。
科技前沿AI行业难得的平静日:信息过载时代的冷思考
当AI行业迎来罕见的平静一天,从业者该如何应对?本文从AINews简报出发,探讨高速发展中的喘息节奏、信息疲劳与内容价值的平衡,以及如何利用平静期进行技术深耕和战略思考。