大佬观点·第5期:OpenAI暂停RL训练、ChatGPT记住你的一切与Perplexity的Agent方向盘论
大佬观点·第5期:OpenAI暂停RL训练、ChatGPT记住你的一切与Pe…
每周五盘点本周行业大佬的发言和官方公告
每周五盘点本周行业大佬的发言和官方公告
李博,这周大佬们又没闲着,我刷推刷到眼花。
我也是,感觉这周信息量特别大。OpenAI一口气发了两条重磅,Perplexity那边也很活跃。
那咱今天就盘一盘,谁说了什么、为什么这个时间点说。
行,我建议先从OpenAI那条最炸的开始。你肯定关心,因为它直接跟产品有关。
你说的是"电脑历史记录"那条吧?OpenAI官推发的,热度一万两千多。
对。原话是ChatGPT现在能记住你在电脑上各个应用和网站的活动。
等等,这是官方公告哦,不是个人观点。桌面版的Computer History功能。
没错,是官方产品通告。逻辑是:记住你的活动,未来交互更个性化,少解释。
我做产品的第一反应是——爽,第二反应是——隐私要炸。
你这个反应太真实了。这就是它的核心张力:便利换隐私。
关键这功能在本地还是云端?记住"各应用和网站"这范围太大了。
官推没细说边界。但方向很清楚,OpenAI在把ChatGPT做成常驻你桌面的Agent。
有意思的是,昨天ProductHunt第一是HyNote,主打完全本地化、数据不出设备。
对比就很戏剧。市场一边在往云端记忆走,一边在往本地隐私走。两条路同时冒头。
那对普通用户意味着什么?我该不该开这个功能?
我的建议是:个人娱乐可以试,涉及工作机密的设备先别开,等边界说清楚。
记下了。那OpenAI第二条是什么?我看热度没这条高。
但这条更重要。OpenAI说,暂停了最新待部署模型的强化学习训练,暂停两周。
暂停RL训练?为什么?这可是罕见操作啊。
原文说,模型越强,内部开发和测试的风险也越大。所以他们停下来加固红队测试。
等于说,是安全原因主动踩刹车。而且最大的前沿RL run还挂起中。
对,先用小规模训练验证对齐证据。这是官方安全声明,不是个人观点,含金量很高。
我插一句——这时间点很微妙。EU AI Act八月初刚全面生效。
你抓得准。监管压力是背景之一。主动公布"我们暂停了",本身就是姿态。
所以这是做给监管看的,还是真觉得危险?
我判断两者都有。但透明地讲出来,说明前沿模型能力确实到了让内部都紧张的程度。
换个角色。Perplexity的Aravind这周话特别多,咱聊聊他。
他最有信号的一条是Agent观点:构建AI Agent时,仍要给人类主动权,手握方向盘。
"手握方向盘"这个类比好。必要时人能干预。这是个人观点哈。
对,是他的产品哲学。有意思的是这跟OpenAI暗合——都在给Agent踩刹车、留缰绳。
一个从安全侧刹车,一个从产品侧留人类控制权。方向居然一致。
这就是把发言放一起看的价值。2026年的关键词不是"更强",是"更可控"。
对了,Aravind还公开认错了一条,回复Gergely说"这事我们做错了"。
对,用户没收到提醒邮件,退款了,还说要全面升级客服。CEO亲自下场认错,挺少见。
他还提了密集模型本地跑很慢,但预示突破将至,700B参数表现惊艳。
这是行业预测。信号是:本地大模型的推理效率,可能很快迎来拐点。
那咱收一收。这周三方声音,你读出什么大方向?
一是记忆化Agent成主战场,二是安全与可控被摆上台面,三是本地推理在逼近。
对我们普通人:能力已经够用,接下来拼的是信任和边界。
总结得漂亮。谁把"可控"和"隐私"讲清楚,谁就能赢下一轮。下周继续盯着他们。
相关推荐
科技前沿GLM-5.2登顶全球开源模型榜首:前端编码能力领跑业界
智谱AI发布GLM-5.2模型,在Artificial Analysis Intelligence Index评测中登顶全球开放权重模型榜首,同时被评为顶级前端编码模型。深入解析GLM-5.2的突破性表现与开源模型竞争格局变化。
科技前沿Reve 2与Ideogram 4对比:AI图像生成布局控制能力全面解析
深度对比Reve 2和Ideogram 4两款AI图像生成模型在布局控制方面的核心突破,分析精确布局技术路径、实用场景及行业趋势,帮助设计师和创作者把握AI可控生成的新方向。
科技前沿Claude Slack智能体升级:多人协作、主动响应与持久记忆全解析
Anthropic为Claude推出Slack集成重大升级,新增多人协作、主动响应和持久记忆三大核心能力,将AI从被动问答工具转变为真正的团队协作伙伴,重新定义企业级AI智能体应用标准。