每日AI新鲜事·08月11日晚间版:Qwen3.8-Max发布与OpenAI IPO
每日AI新鲜事·08月11日晚间版:Qwen3.8-Max发布与OpenAI…
2026年08月11日(周二)晚间版 AI新闻速递+热点深度讨论
2026年08月11日(周二)晚间版 AI新闻速递+热点深度讨论
今天AI圈消息不少,有融资大新闻,也有技术圈的新玩法,咱们先快速过一遍。
第一条,Hacker News上刚看到,OpenAI完成了70亿美元的股份出售,而且是在潜在IPO之前。
70亿美元,这个数字放在任何行业都算炸裂了。而且注意措辞,ahead of potential IPO,说明上市这件事基本上已经是箭在弦上了。
对,从非营利到营利转型那段争议还历历在目,现在直接要奔上市去了。
这也说明资本市场对AI赛道的信心还是很足的,毕竟GPT-5、Sol系列已经证明了商业化能力。七十亿只是热身,真IPO的话估值还得往上走。
好,第二条挺有意思。YouTube上有个视频火了,标题叫'I made Claude smarter by writing it a letter',就是通过给Claude写一封信来提升它的表现。
这其实就是精细化的system prompt工程嘛。但我觉得这个标题起得好,'写一封信'这个比喻比'prompt engineering'亲切多了。
视频作者还提到自己最近一直在疯狂写代码,提了好几十个PR,感觉AI辅助编程确实改变了很多人的工作节奏。
是的,现在用Claude Code这类工具的人,产出效率跟以前完全不是一个量级。写信调教模型这种技巧,本质上是在做人机协作的微调。
再来一条,Hacker News上有人对DeepSeek做了逆向工程分析,方法挺有创意的——通过'采访'DeepSeek自己来逆向它。
用模型的输出行为去推断它的训练方式和系统设定,这在研究圈叫model interrogation。之前也有人对GPT系列做过类似的事。
考虑到DeepSeek最近刚预告了API大幅涨价,这个时间点做逆向分析还挺应景的,大家可能想搞清楚到底值不值这个新价格。
确实,涨价前摸清家底嘛,理性消费。
最后还有个Reddit帖子,有人吐槽Gemini生成动漫风格图片效果不好,画出来过于光滑油腻,说ChatGPT就能正常生成。
这个问题其实挺典型的,Google的图像模型在风格控制上一直不太稳定,尤其是动漫这种需要特定笔触质感的风格。
好了新闻就先聊到这儿,接下来咱们聊聊最近一个特别火的话题——阿里刚发布了Qwen3.8-Max。
这个必须聊。B站上相关视频互动量都破千了,一个讲模型能连续干活的,一个直接把它定位成对OpenAI和Anthropic的最新挑战。
李博你先给大家说说,Qwen3.8-Max这个命名怎么理解?从Qwen3到3.8,跨度不小啊。
阿里的命名逻辑是版本号加能力等级,3.8代表的是在Qwen3基础上的重大迭代,Max则是最高规格的版本。可以理解为他们目前的旗舰模型。
B站上有个视频重点提到了'连续干活'这个特性,这是什么意思?
简单说就是agent能力的大幅增强。以前的模型你给一个任务它做完就停了,现在Qwen3.8-Max能够自主规划、拆解任务,然后一个接一个地执行下去。
这不就是大家一直在追求的那种真正的AI助手嘛,不用你一步步喂指令。
对,而且这个能力的提升跟前阵子Claude Code和Devin走的方向是一致的。整个行业都在从单轮对话往multi-step agent方向转。
说到这个,Reddit的singularity板块有个帖子直接说'Google needs to up their game',讨论还挺热的。你觉得这跟Qwen的发布有关系吗?
肯定有关系。你看现在的竞争格局,OpenAI有Sol系列,Anthropic有Fable 5,阿里现在推出Qwen3.8-Max,每家都在加速迭代。Google呢?
Google有Gemini 2.0啊,不过确实好像最近声量没那么大了。
问题就在这。Gemini 2.0发布都快一年了,中间虽然有更新,但没有一个让人眼前一亮的大版本。刚才那个动漫图片生成的吐槽就是一个缩影。
Reddit上大家的核心不满是什么?
主要两点。第一,模型能力的迭代节奏跟不上竞争对手。第二,产品层面的整合太碎片化了,Google有搜索、有Android、有云服务,但AI体验串不起来。
这个我有体感,Google的AI功能散落在各个产品里,但你很难说出一个完整的、让人印象深刻的AI产品体验。
反观阿里,Qwen系列虽然起步晚,但迭代速度非常快。从Qwen2到3再到3.8-Max,每一代都有明确的能力跃升,而且开源生态也做得不错。
而且B站视频里把Qwen3.8-Max定位成'对OpenAI和Anthropic的最新挑战',你觉得这个定位准确吗?
在中文场景和特定任务上,Qwen确实有竞争力。但要说全面挑战GPT-5.6 Sol或者Fable 5,我觉得还需要看更多的独立评测数据。
你的意思是能力还有差距?
不是简单的差距问题。现在各家模型其实在不同维度上各有强项,比如之前我们聊过Fable 5在工具调用上反超Sol。Qwen3.8-Max的'连续干活'能力如果真的很强,那它在agent场景下可能有独特优势。
所以现在的竞争已经不是一个综合排名能说清楚的了,每家都在找自己的差异化方向。
没错,这也是为什么Google被批评。不是说Gemini不行,而是它没有一个让人记住的独特强项。WeatherNext那种垂直领域的突破很厉害,但消费者感知不到。
回到Qwen3.8-Max,你觉得它对国内开发者生态的影响会怎样?
影响会很大。阿里云本身就有庞大的企业客户基础,加上Qwen系列的开源策略,国内做AI应用的团队现在有了一个能力更强的本土选择。
而且考虑到DeepSeek要涨价,时机卡得还挺巧的。
小雨你这个观察很敏锐。DeepSeek涨价,Qwen出新模型,这对开发者来说多了一个迁移选项。竞争对用户永远是好事。
总结一下的话,今天最大的感受就是AI竞争真的进入了多极化的阶段,美国公司之间在打,中国公司也在快速追赶,Google反而成了被催促的那一个。
而且这个竞争的维度也变了,不再只是比benchmark分数,而是比agent能力、比生态、比商业化速度。谁能在这些维度上跑出来,谁就是下一阶段的赢家。
好,今天就聊到这儿。明天见。
明天见。
相关推荐
科技前沿GLM-5.2登顶全球开源模型榜首:前端编码能力领跑业界
智谱AI发布GLM-5.2模型,在Artificial Analysis Intelligence Index评测中登顶全球开放权重模型榜首,同时被评为顶级前端编码模型。深入解析GLM-5.2的突破性表现与开源模型竞争格局变化。
科技前沿Reve 2与Ideogram 4对比:AI图像生成布局控制能力全面解析
深度对比Reve 2和Ideogram 4两款AI图像生成模型在布局控制方面的核心突破,分析精确布局技术路径、实用场景及行业趋势,帮助设计师和创作者把握AI可控生成的新方向。
科技前沿In the Weights:查看你在AI领域的影响力权重分数
In the Weights 是一个AI领域个人影响力搜索引擎,通过量化评分衡量你在人工智能世界中的存在感。了解这个工具如何评估AI从业者的多维度影响力,以及它背后关于数字身份的深层思考。