DeepSeek V4即将上线,美团开源1.6万亿参数LongCat 2.0

DeepSeek V4正式版预告:7月中旬上线,API引入峰谷定价
DeepSeek近日向用户发送邮件,正式预告DeepSeek V4正式版计划于7月中旬上线,官方称将带来更多功能优化与性能提升。继V3系列之后,DeepSeek旗舰模型的迭代节奏依然维持在业界前列。
值得关注的是API商业化策略的调整。正式版发布后,DeepSeek将引入峰谷定价机制——现行价格作为平时基准价,每日9点至12点、14点至18点被定义为高峰时段,此时段价格将上调至平时的两倍。这一设计与云计算领域常见的错峰定价逻辑一致,本质上是通过价格杠杆引导用户将非紧急任务转移至低峰时段,从而缓解推理集群在工作时间的算力压力。对于开发者而言,合理调度批处理任务的时间窗口将直接影响使用成本。
美团开源LongCat 2.0:1.6万亿参数的国产算力实践
美团龙猫(LongCat)团队正式发布并开源了LongCat 2.0,这是一款总参数量高达1.6万亿、激活参数480亿的MoE(混合专家)语言模型。官方特别强调,该模型在国产算力芯片上完成了一体化训练——这一细节在当前算力供应格局下具有重要产业意义,表明国产芯片已具备支撑万亿级大模型完整训练的能力。
LongCat 2.0支持100万token的超长上下文,官方称其在编程与智能体(Agent)任务上表现强劲。目前模型已通过LongCat API开放平台上线,提供限时资源包及按量计费服务。对国内开发者而言,一款主打Agent与长文本、完全开源的万亿级模型,为工程实践提供了更多本土化选择。
Codex风波:用量异常消耗与紧急热修复
Codex团队宣布完全重置用量限制,并在24小时内向用户额外增加一次手动重置额度。此举源于多位用户此前报告的用量消耗过快问题。

团队调查后确认,异常并非单一原因所致,而是由AutoReview过于主动、后台建议重试频繁等多个小问题叠加造成。目前团队已撤销相关改动,并在各平台部署热修复。这类"多机制叠加引发系统性异常"的案例在Agent产品中并不罕见——当多个自动化流程同时激进运行时,很容易造成资源的隐性放大消耗。
此外,OpenAI还为Codex推出了Beta阶段的权限配置文件功能,替代旧版沙箱模式。该功能通过可继承的配置策略精细控制文件读写与网络访问权限,内置只读、工作区写入和完全访问三种模式,并由操作系统强制实施,安全粒度显著提升。
移动端Agent集中爆发:Cursor与OpenCode上线App
这一天成为AI编程工具移动化的重要节点。Cursor正式发布iOS应用,向所有付费用户开放公开测试,可从App Store下载。用户可在手机上启动云端Agent或远程控制桌面Agent,通过锁屏实时动态和推送通知掌握任务状态,甚至查看演示代码并合并Pull Request。

几乎同时,OpenCode官方发布iOS和Android原生移动应用。两款应用作为自托管AI Agent Gateway的伴随节点,能够将手机硬件接入用户的个人Agent网络。两者思路一致:让开发者摆脱对桌面环境的强依赖,实现随时随地监控与干预长时间运行的Agent任务。这标志着编程Agent正从"IDE内工具"演变为"跨设备的持续服务"。
Cline也在同期推出ClinePass订阅服务,开发者可直接使用GLM 5.2等精选开放权重模型,标准月费9.99美元,命令行注册用户首月仅1.99美元。
企业级部署与生态整合加速
面向企业市场的整合动作同样密集。Anthropic推出自托管的Claude Apps Gateway,支持企业SSO、集中策略与支出上限,可将Claude Code路由至Amazon Bedrock和Google Cloud。同时Anthropic宣布Claude模型已全面接入由Azure托管的Microsoft Foundry平台,首发提供Claude Opus 4.8和Haiku 4.5,直接整合现有Azure身份验证、治理控制与计费体系。这意味着Anthropic正加速覆盖三大云平台,持续降低企业采用门槛。
Claude Code团队成员Boris Cherny透露,下个版本将使Subagents默认在后台运行,用户可在Subagents执行任务时继续对话,该特性已向少量用户逐步推出。
前沿研究:脑机解码与推理效率优化
Meta AI公布非侵入式脑文本解码研究新成果Brain-to-Query Clarity v2。该系统基于端到端深度学习,能够从脑磁图信号实时解码完整句子,官方称单词准确率达61%,并开源了训练代码与数据集。作为非侵入式方案,61%的准确率虽距实用尚有差距,但开源姿态为脑机接口研究提供了宝贵的公共资源。
国内方面,小红书推出长文本推理引擎RedKnot,通过解耦注意力机制提升效率,官方论文称最高带来3.54倍首次延迟加速。此外,美国National Design Studio发布了仅14.7MB的开源模型Rampart,可在浏览器内自动脱敏姓名、地址等个人信息后再发送给AI助手,支持7种语言,为隐私保护提供了轻量级本地方案。
消费级功能与行业动态速览
Google Gemini向美国用户免费开放Personalized Image生成功能,将Personal Intelligence与Nano Banana模型及Google Photos打通,使Gemini能从用户连接的应用中理解偏好与生活细节,生成贴合个人形象的图像。

国内产品方面,有用户分享豆包近期出现类似即时通讯的对话页面,可添加飞书好友。豆包官方回应否认内测社交功能,称仅为办公场景与飞书的协同整合。

此外,月之暗面发布声明澄清未授权任何第三方处理其融资与股权转让,提醒投资者警惕非官方渠道。AI评估平台Arena宣布商业化仅8个月年化营收便突破1亿美元,依托千万用户盲测生成的模型排行榜按用量向企业收取深度分析费用,展现了"评测即服务"这一新商业模式的潜力。OpenAI还预告将发布一款Codex相关新硬件,据视频显示将与外设厂商合作推出专为Codex打造的键盘产品。
相关推荐

开源权重模型之争:安全与开放如何平衡
深入分析开源权重模型的核心争论:模型权重公开发布带来透明度与创新,但也引发安全滥用风险。本文探讨分级发布、红队测试等折中方案,解读开源AI背后的行业博弈与治理挑战。

抱怨如何侵蚀你的心智:注意力自我强化效应解析
习惯性抱怨正在训练大脑发现更多负面信息,形成恶性循环。本文从注意力自我强化机制出发,解析抱怨的心理侵蚀过程,并提供主动管理注意力、跳出负面循环的实用方法。

Steam恶意软件溯源:比特币、Cookie和外卖订单如何锁定攻击者
一起Steam恶意软件案件中,调查人员通过比特币交易链、Google Cookie和Uber Eats外卖订单三条线索交叉验证,成功溯源攻击者真实身份。深入解析数字取证技术与匿名幻觉。