Cursor三大重磅发布:移动端、Git平台与自研大模型

在近日举办的Cursor社区活动上,联合创始人Michael回顾了公司从2022年1月创立至今的发展历程,并正式发布了三项重大产品更新:Cursor Mobile移动应用、Origin代码协作平台,以及从零训练的新一代自研大模型。这些发布标志着Cursor从一个AI代码编辑器,正式迈向全栈AI开发平台。
从四个程序员到AI编程平台
2022年初,四位年轻程序员组成的团队看到AI编程赛道已有数十家创业公司和大厂入局,一度认为"没有空间了"。但到年底,他们发现市场上没有一款真正让自己满意的工具,于是"躲进洞里穿着内裤写了两周代码",做出了第一个原型。
最初的20位Beta测试者中,前两位用户反应冷淡甚至直接"消失",但团队坚持了一个核心循环:每天思考如何让产品对自己更好用,对社区更有价值。这个循环延续至今。
如今Cursor已完成向"Agent优先"的彻底转型。这里的Agent(智能代理)指的是能够自主规划、执行多步骤任务的AI系统,区别于传统的单次问答或代码补全。Agent可以理解高层意图,自动分解任务、调用工具、读写文件、运行命令,并根据执行结果动态调整策略。这种范式转变意味着开发者从"逐行编写代码"转向"描述目标并监督执行",类似于从亲自施工转变为指挥施工团队。
数据显示:超过95%的用户主要将Cursor作为Agent使用,Agent的请求量是辅助功能(如Tab补全)的5倍以上,按代码行数计算则是数个数量级的差距。

Cursor 3:为Agent而生的开发环境
最新发布的Cursor 3在产品形态上做了根本性重构。左侧是Agent面板,中间是Agent工作区,同时保留了专业开发环境的所有能力——文件编辑、远程SSH、语言服务器(LSP,为编辑器提供代码智能提示、跳转定义、重构等能力的后台服务)和代码检查一个不少。
几个值得关注的新特性:
-
Design Mode:可以直接指向屏幕上的UI元素,让Agent修改特定组件。这种"所见即所得"的交互方式消除了开发者需要用文字精确描述UI位置的认知负担,将视觉指向转化为精确的代码定位。
-
递归子Agent:Agent可以调用子Agent,形成完整的Agent团队协作。这是一种多Agent协作架构,主Agent可以将复杂任务分解后委派给专门的子Agent处理。例如,一个负责重构的主Agent可能调用一个专门处理测试的子Agent和一个负责文档更新的子Agent。这种架构借鉴了软件工程中的分治思想和微服务理念,使得AI系统能够处理远超单一Agent上下文窗口限制的大型任务。
-
云端Agent升级:Agent拥有独立的开发环境(类似于容器化的沙箱),可以运行测试、生成截图、持续工作数天。这意味着Agent不再受限于用户本地机器的资源和在线时间。
团队的产品哲学很明确:与Agent协作应该像与同事协作一样自然,不仅是文字对话,还要能"一起指着屏幕讨论"。

三大重磅发布
Cursor Mobile:随时随地管理AI Agent
产品负责人Kevin介绍了移动端应用的设计理念:当Agent成为7×24小时运行的基础设施时,开发者需要随时随地与它们交互。这反映了软件开发工作流的根本性变化——过去开发者离开电脑意味着工作暂停,而现在Agent持续运行意味着开发者需要一个轻量级的监控和指挥界面。
Cursor Mobile的核心功能包括:
- 查看所有运行中的Agent状态,识别被阻塞的任务
- 查看Agent生成的截图等产出物
- 直接在截图上标注反馈,重新指导Agent工作
- 远程控制本地Agent(适合桌面有Mac Mini集群的用户)
云端Agent在过去几个月实现了3倍速度提升和99.9%可用性(即全年停机时间不超过约8.7小时)。自动化功能上线仅数月,已累计超过600万次自动化运行。客户Amplitude(一家产品分析平台公司)正用它批量迁移2万个React组件到Tailwind CSS——这类大规模机械性重构正是Agent最擅长的场景,人工执行可能需要数月,而Agent可以在数天内完成。
Origin:Agent原生的Git平台,正面挑战GitHub
通过收购Graphite团队,Cursor推出了Origin平台,正式向GitHub发起挑战。Graphite是一家专注于代码评审和堆叠式PR(Stacked Pull Requests)工作流的开发工具公司,其核心理念是将大型代码变更拆分为小的、可独立评审的增量提交,从而加速代码评审流程。该团队曾服务Shopify、Snowflake、Notion、Figma等工程文化顶尖的公司,积累了深厚的Git工作流优化经验和对大规模工程团队痛点的理解。

Origin的三个核心设计原则:
规模化:全新的Git架构设计,在负载测试中模拟数千Agent同时对单一仓库进行推拉操作,性能满足当前和未来需求。传统Git基于快照和有向无环图(DAG)的设计,在少量开发者协作时表现优异,但当数千个Agent同时操作时,锁竞争、合并冲突和引用更新会成为严重瓶颈。GitHub的架构虽经过多年优化,但其设计假设仍基于人类开发者的操作频率(每天数次到数十次推送)。Origin需要从底层重新设计并发控制、冲突解决和分支管理策略,以适应Agent时代数量级增长的操作频率(每分钟数百次推送)。
可扩展:通过API、MCP和第三方应用平台,开发者和Agent可以在Origin上构建任何所需功能,提供充足的速率限制和完整的API控制。MCP(Model Context Protocol)是Anthropic于2024年底推出的开放协议标准,旨在为AI模型提供统一的外部工具和数据源接入方式。类似于USB为硬件设备提供标准接口,MCP为AI Agent提供了连接数据库、API、文件系统等外部资源的标准化方式,使得不同工具和平台之间可以实现互操作。
保持代码流动:利用Cursor的AI能力自动解决合并冲突、修复CI(持续集成,代码提交后自动运行测试和构建的流水线)失败、处理评审意见,自动判断每个PR(Pull Request,代码合并请求)的下一步操作,仅在必要时通知开发者,将代码评审时间缩短一半以上。在传统工作流中,一个PR从提交到合并平均需要等待数小时甚至数天的人工评审,而AI驱动的自动化可以将大部分机械性检查和修复前置完成。
Origin已在Cursor内部和部分设计合作伙伴中上线,计划今年秋季全面开放。
从零训练的前沿自研大模型
这是最具野心的发布。Cursor宣布正在训练一个全新模型,与此前的Composer系列有本质区别:
规模达到前沿水平:参数量与Opus(Anthropic的旗舰模型Claude Opus)、GPT(OpenAI的GPT-4系列)同级别,意味着可能在数千亿参数规模。
从零训练:不再基于开源模型微调,而是完全自主训练,以便精确控制模型行为。微调(Fine-tuning)是在已有预训练模型基础上用特定领域数据进行额外训练,成本较低但受限于基础模型的架构和知识边界。从零训练(Pre-training from scratch)则意味着从随机初始化的权重开始,完全控制训练数据配比、课程学习策略、架构设计和对齐方式。这赋予团队对模型行为的精确控制力——例如可以让模型天然理解代码编辑的diff格式、工具调用的最优策略等——但需要数千万美元级别的算力投入和顶尖的基础设施工程能力。
10-20倍算力提升:这是关键突破。此前Composer系列受限于GPU资源,很多改进方向被算力瓶颈阻断。这次大规模扩展让团队有信心追赶甚至超越前沿实验室。按照当前GPU定价估算,10-20倍的算力提升意味着训练预算可能从数百万美元跃升至数千万美元级别。
超越纯编码能力:新模型将具备工具使用、长程规划、软件测试、UI交互等通用智能,因为"工程师同事"需要的远不止写代码。这反映了业界对AI Agent能力的共识——真正有用的编程Agent需要理解产品需求、设计测试策略、调试复杂系统,而不仅仅是将自然语言翻译为代码。

这一切背后是与Meta的合作伙伴关系(Meta拥有大规模GPU集群和开源模型Llama系列的训练经验)。Michael强调,Cursor是极少数能同时深度设计产品和模型的公司,而且其DNA是"开发者为开发者构建",这与大厂或实验室出身的竞争者有本质区别。
模型演进:从Tab到Composer
回顾Cursor的模型之路:2023年的Tab补全模型"悄悄成为最流行的编码模型之一"——这类模型专注于预测开发者下一步要输入的代码,延迟要求极低(通常需要在300毫秒内返回结果),因此采用参数量较小但推理速度极快的专用架构。
2024-2025年通过小型代理模型弥补API模型的工具调用短板。由于直接调用Claude或GPT等大模型的API存在延迟高、成本高、工具调用格式不统一等问题,Cursor训练了专门的小型模型来处理路由决策、工具选择和结果整合。
Composer 1实现了大规模强化学习;Composer 2引入了数十万亿token的持续预训练和实时RL(每5小时更新一次模型)。传统强化学习从人类反馈(RLHF)通常是离线批处理过程,模型更新周期以周或月计。Cursor的实时RL每5小时更新一次模型,意味着系统能够快速从用户的接受/拒绝行为中学习,持续优化代码生成质量。这种在线学习方式类似于推荐系统的实时反馈循环,但应用于代码生成领域在技术上更具挑战性,因为代码正确性的验证远比点击率复杂——需要考虑编译通过、测试通过、代码风格一致性等多维度信号。
团队特别强调了成本和速度的重要性:"如果最强大的模型只有大公司用得起,那将是一个悲哀的世界。"他们希望独立开发者和个人黑客也能使用最好的模型。这一理念的技术实现依赖于推理优化(如投机解码、KV缓存共享、模型蒸馏等技术),使得大模型的单次调用成本持续下降。
平台化战略
Cursor正从封闭产品走向开放平台,这是软件公司从工具向生态系统演进的经典路径(类似于Salesforce从CRM工具发展为企业应用平台):
- SDK发布:不仅人类可以使用Cursor,其他Agent也可以通过编程接口调用。这意味着Cursor可以被嵌入到更大的自动化工作流中,例如CI/CD流水线中的自动代码修复、项目管理工具中的自动任务执行等。
- 插件生态:支持Datadog(应用监控平台)、数据库、设计工具等各类集成,让Agent能够获取生产环境的日志、性能指标和设计稿等上下文信息。
- CLI增强:过去数月进行了50多项改进,支持无头模式(Headless Mode,无需图形界面即可运行)运行,适合服务器端和自动化场景。
- 多端覆盖:桌面、Web、终端、移动端全面覆盖
总结
从2022年四个程序员的"洞穴创业",到如今发布移动端、挑战GitHub、训练前沿大模型,Cursor的野心已经远超一个代码编辑器。Michael在演讲中反复强调的核心信念是:这是一家"开发者为开发者构建"的公司,而现在他们第一次拥有了从产品像素到模型权重的完整控制力——这种垂直整合能力在AI应用公司中极为罕见,通常只有Apple这样的公司才追求从硬件到软件的全栈控制。新模型将在未来几周内发布,值得持续关注。
相关推荐

开源权重模型之争:安全与开放如何平衡
深入分析开源权重模型的核心争论:模型权重公开发布带来透明度与创新,但也引发安全滥用风险。本文探讨分级发布、红队测试等折中方案,解读开源AI背后的行业博弈与治理挑战。

抱怨如何侵蚀你的心智:注意力自我强化效应解析
习惯性抱怨正在训练大脑发现更多负面信息,形成恶性循环。本文从注意力自我强化机制出发,解析抱怨的心理侵蚀过程,并提供主动管理注意力、跳出负面循环的实用方法。

Steam恶意软件溯源:比特币、Cookie和外卖订单如何锁定攻击者
一起Steam恶意软件案件中,调查人员通过比特币交易链、Google Cookie和Uber Eats外卖订单三条线索交叉验证,成功溯源攻击者真实身份。深入解析数字取证技术与匿名幻觉。