纯Vibecoding打造130+卡牌多人对战CCG:全AI技术栈拆解

当AI成为唯一的开发者
一位主要从事移动端开发的独立开发者,在Reddit上分享了他的一个大胆实验:完全依靠vibecoding(凭感觉编程,即高度依赖AI代理完成编码工作),构建了一款可在浏览器直接游玩的多人卡牌对战游戏(CCG)——《Boomstick City》。
Vibecoding是2024-2025年间在开发者社区中兴起的一种新型开发范式,最早由Andrej Karpathy等AI研究者推广。其核心理念是开发者不再逐行编写代码,而是通过自然语言描述需求、审查AI生成的输出、并在高层次上引导项目方向。这与传统的"pair programming"(结对编程)有本质区别——在vibecoding中,AI不是辅助角色,而是主要的代码产出者,人类则退居为需求定义者和质量把关者。这种范式的兴起与大语言模型代码生成能力的飞速进步直接相关,尤其是Claude、GPT-4等模型在2024年后展现出的多文件项目理解和跨模块协调能力。
这不是一个玩具级Demo。这款游戏拥有130+张卡牌、4个阵营、完整的多人对战服务器,以及AI生成的卡面美术和角色配音。CCG(Collectible Card Game,集换式卡牌游戏)是一个有着悠久历史的游戏类型,最早可追溯到1993年的《万智牌》(Magic: The Gathering),数字化CCG在2014年《炉石传说》大获成功后迎来爆发期。130+张卡牌的设计意味着需要考虑每张卡的数值、效果、与其他卡牌的交互关系,开发复杂度远超一般认知。作者坦言,这是他第一个真正有分量的Web项目,而他想知道"纯vibecoding能把项目推进到什么程度"。答案是:"显然,一路到底。"

游戏设定与玩法设计
《Boomstick City》采用后末世题材,但视角相当接地气——玩家扮演的是"社区居委会"和"工会化的拆迁队"这类组织,在世界末日后挣扎求生。这种黑色幽默的设定为传统卡牌游戏注入了新鲜感。
玩法上采用竞速积分制:率先累积15分者获胜。得分方式有两种——赢得战斗,或者在敌方场地清空时突袭中央目标。这种设计让对局节奏更快,也提供了进攻和资源争夺两种策略路线。相比传统CCG中"削减对手生命值至零"的胜利条件,积分制设计降低了单局时长,更适合浏览器端的碎片化游戏场景。从游戏设计理论来看,这种"多路径达成胜利条件"的机制增加了策略深度——玩家需要在"专注战斗得分"和"伺机突袭中央目标"之间动态切换,这比单一胜利条件创造了更多的决策节点和心理博弈空间。作者提到,他原本还为每个"区域"(可游玩的战场)设计了不同的增益效果,但很快发现这让游戏变得混乱难懂,最终被砍掉,留待未来迭代。
全AI技术栈拆解:Vibecoding工具链详解
真正让这个项目值得关注的,是它背后近乎全AI驱动的技术栈。作者列出了完整的工具链,这几乎是一份独立开发者"AI生产力工具"的完整清单:
AI编码核心工具
- Claude Code:作为整个构建过程的"驾驶者"(driver),负责主导开发流程;
- Opus 4.8:承担实际的代码编写工作;
- Fable:用于代码审计与检查,充当质量把关的角色。
Claude Code是Anthropic于2025年推出的命令行AI编程工具,它与普通的聊天式AI辅助编程有显著区别。Claude Code能够直接读取和修改本地文件系统中的代码,理解整个项目的目录结构和文件间依赖关系,并通过agentic loop(代理循环)自主规划和执行多步骤的编码任务。所谓agentic loop,是指AI系统在接收到高层次指令后,能够自主进行"思考-行动-观察"的循环:分析当前代码状态、规划下一步操作、执行代码修改、观察结果(如编译输出或测试结果)、再基于观察决定后续行动。这种循环使AI能够处理远比单次问答复杂得多的任务。开发者可以给出高层次指令如"为这个卡牌游戏添加一个回合制战斗系统",Claude Code会自行分析现有代码架构、创建必要的文件、编写实现代码并运行测试。这种自主性使其成为vibecoding的核心引擎。
这种"主力编码模型 + 审计模型"的组合值得玩味。它反映出一个正在成型的AI辅助开发范式:不是让单一模型一把梭到底,而是引入独立的审查环节来交叉验证代码质量,某种程度上模拟了人类团队中"开发"与"Code Review"的分工。这一策略的理论基础是:不同模型在不同类型的错误上具有不同的盲区,交叉验证能显著提升代码的可靠性,类似于软件工程中"四眼原则"(four-eyes principle)的AI化实现。在传统软件工程中,四眼原则要求每一段代码在合并到主分支前必须经过至少一位非作者的审查者检视,研究表明这能将缺陷逃逸率降低60-90%。将同样的理念应用于AI工具链,用一个独立的模型来审查另一个模型的输出,理论上能捕获主力模型的系统性偏见和常见错误模式。
多人服务器与AI内容生成
- Colyseus:处理多人对战的服务器逻辑。这是一个成熟的开源多人游戏框架,也是整个技术栈中少数"非AI"的传统基础设施;
- GPT:生成全部130+张卡牌的美术图;
- ElevenLabs:负责角色配音。
Colyseus是一个基于Node.js的开源多人游戏服务器框架,专门为实时多人游戏设计。它提供了房间管理(Room)、状态同步(State Synchronization)、消息广播等核心功能,使用Schema-based的序列化机制来最小化网络带宽消耗。对于CCG这类回合制游戏,Colyseus的状态同步机制尤为适合——服务器维护权威的游戏状态(如双方手牌、场上单位、生命值等),客户端通过增量更新保持同步。这种"权威服务器"架构是对抗作弊的关键设计——所有游戏逻辑判定(如一张卡能否被打出、伤害计算是否正确)都在服务器端执行,客户端仅负责显示和输入,即使客户端被篡改也无法影响游戏结果。选择Colyseus而非自建WebSocket服务器,反映了即使在AI主导编码的流程中,经过社区验证的成熟框架仍然是降低风险的最佳选择。
ElevenLabs是当前AI语音合成领域的领头羊之一,其技术核心是基于Transformer架构的文本转语音(TTS)模型,能够生成极其逼真的人声,并支持情感控制、语速调节和多语言切换。传统的角色配音需要聘请专业配音演员、租用录音棚、进行多轮录制和后期处理,成本通常在数千到数万美元不等。ElevenLabs将这一成本压缩到几乎可以忽略的水平,使得独立开发者也能为游戏中的每个角色赋予独特的声音特征。更值得注意的是,AI配音还带来了迭代速度的质变——如果后续需要修改某段台词或新增角色,传统方式可能需要重新预约配音演员并安排录制,而AI配音只需修改文本输入即可在几秒内获得新的音频文件。
说个细节,代码、美术、配音三大内容生产环节全部由AI承担,作者本人更多扮演的是"产品经理"和"指挥者"的角色。对于一个单枪匹马的移动端开发者来说,这在过去几乎是不可想象的工作量——传统上,一款类似规模的CCG至少需要程序员、美术师、音效师、游戏设计师四类角色的协作,团队规模通常在5-10人以上,开发周期以年为单位计算。以《炉石传说》为参照,暴雪投入了约15人的核心团队花费超过两年时间进行初始开发,而一位独立开发者借助AI工具链达到了类似的功能覆盖度(尽管打磨程度不可同日而语),这本身就是一个时代性的信号。
Vibecoding的能力边界:AI编程能做到什么程度
这个项目最有价值的地方,不在于游戏本身有多完美,而在于它为"AI能独立完成多复杂的软件"这个问题提供了一个真实样本。
Vibecoding证明了什么
一个非Web领域的开发者,借助AI工具链,独立完成了包含实时多人同步、复杂卡牌逻辑、完整美术和音效的完整产品,并成功上线运营(www.BoomstickCity.com,免注册直接游玩)。这说明当前的AI代理已经能处理具备真实技术深度的项目,而不仅仅是CRUD应用或静态页面。实时多人同步涉及网络延迟补偿、状态一致性保证、断线重连等复杂的分布式系统问题;卡牌逻辑则需要处理大量条件判断、效果堆叠和优先级解析——这些都是传统上需要资深工程师花费大量时间调试的领域。
具体而言,网络延迟补偿(latency compensation)是多人游戏中最棘手的问题之一。当两个玩家分别位于不同大洲时,网络往返时间可能超过200毫秒,系统需要确保双方看到的游戏状态保持一致,同时又不能让玩家感受到明显的操作延迟。对于CCG这类回合制游戏,这一问题相对FPS(第一人称射击)游戏要简单得多,但仍然需要正确处理诸如"两个玩家几乎同时出牌"这类竞态条件(race condition)。效果堆叠和优先级解析则是CCG特有的复杂度——当多张卡牌的效果同时触发时(例如"受到伤害时回复1点生命"和"回复生命时对对手造成等量伤害"),系统需要有明确且一致的解析顺序,否则会产生逻辑矛盾或无限循环。
Vibecoding暴露了什么
作者自己反复强调的一个痛点是卡牌平衡(balancing)。他说这"花了非常久的时间",并在帖子中特别恳请社区就平衡性给出反馈。这恰恰揭示了vibecoding的边界:AI擅长快速生成功能代码,但涉及需要大量迭代、需要真实玩家数据反馈、需要"设计手感"的领域,AI依然力不从心。
卡牌平衡性之所以是AI难以解决的问题,根源在于它是一个多维度的复合优化问题。一张卡牌的"强度"不是孤立存在的——它取决于与其他所有卡牌的组合关系(协同效应和克制关系)、当前的meta环境(玩家群体偏好的策略)、以及不同技术水平玩家的使用效率差异。传统CCG如《万智牌》和《炉石传说》投入了数十人的设计团队和数年的数据积累来持续调整平衡,即便如此仍频繁出现需要紧急削弱(nerf)或禁用卡牌的情况。这本质上是一个需要大规模真实玩家行为数据才能有效优化的领域,纯粹的理论推演和AI模拟难以覆盖人类玩家会发现的所有极端组合。以130张卡牌为例,仅考虑两两组合就有超过8000种可能的交互关系,而实际的卡组构建涉及20-40张卡牌的选择,其组合空间是天文数字级别的。即使用AI模拟对战来测试平衡,AI的策略探索也无法完全代表人类玩家的创造性——人类玩家往往能发现设计者完全没有预料到的破坏性组合(通常被称为"broken combo"或"无限循环"),这些极端案例恰恰是平衡性调整中最关键也最难预测的部分。
平衡性本质上是一个游戏设计问题,而非工程问题,这类问题目前仍高度依赖人类的经验判断。那个被砍掉的"区域差异化增益"设计也是同理——技术上完全可以实现,但"很快就变得混乱难懂",最终因为体验和设计层面的考量被移除。AI能构建复杂系统,但判断复杂系统是否"好玩"的责任,仍然落在人类身上。
给独立开发者的启示:AI编程新工作流
《Boomstick City》是一个信号意义大于产品意义的案例。它勾勒出一种新的独立开发工作流:
-
AI工具链专业化分工:不再是单一AI包办,而是让不同模型(Claude Code主导编码、Fable审计、GPT出图、ElevenLabs配音)各司其职。这种多模型协作模式类似于微服务架构的理念——每个AI工具专注于自己最擅长的领域,通过人类开发者作为"编排层"来协调整体产出。在软件架构演进史中,从单体应用到微服务的转变释放了巨大的开发效率,同样的逻辑正在AI工具链中重演:与其期待一个"万能AI",不如组合多个专精工具。这也意味着未来开发者的核心技能之一将是"AI工具编排能力"——知道在什么阶段用什么工具、如何定义工具间的接口和交接标准;
-
传统基础设施仍不可少:Colyseus这样的成熟框架依然是可靠底座,AI并未取代整个工程生态。网络协议、数据库、部署运维等底层基础设施短期内仍需依赖经过生产环境验证的传统方案。这一点值得强调——AI生成的代码仍然需要运行在真实的服务器上、通过真实的网络传输、存储在真实的数据库中,这些基础设施层面的可靠性和性能优化是几十年软件工程积累的成果,不是AI代码生成能够绕过的;
-
人类角色向上迁移:开发者从"写代码"转向"定义需求、把控体验、做设计决策",尤其在平衡性、玩法趣味这些主观领域。这一趋势与软件行业的历史演进一脉相承——从机器码到汇编语言、从汇编到C/C++等高级语言、从高级语言到Python/JavaScript等脚本语言和框架、再到如今的AI代理,每一次抽象层级的提升都将开发者推向更高层次的决策工作。1950年代的程序员需要管理寄存器和内存地址,1990年代的程序员需要关注算法和数据结构,2020年代的程序员需要做架构决策和系统设计,而AI时代的开发者可能主要需要做产品决策和用户体验判断。
作者还埋了一个社区彩蛋:在游戏设置中输入兑换码"REDDIT"可获得一张名为"The Red It"的专属卡牌——这种面向社区的运营意识,同样是AI暂时无法替代的产品直觉。它体现的是对用户心理和社区文化的深层理解,这种"知道什么会让特定群体感到惊喜和认同"的能力,本质上是一种社会性智慧。Reddit社区有着强烈的"内群体"认同感,专属彩蛋不仅是一种营销策略,更是向社区表达"我是你们中的一员"的信号。这种基于社会认知的决策——理解特定群体的文化符号、情感触发点和归属需求——依赖于对人类社会动态的深层理解,是当前AI最不擅长的领域之一。
对于观望AI编程能力的开发者而言,这个案例的结论或许是:技术实现的门槛正在被AI快速拉平,而产品判断力和设计品味的价值反而在上升。 当"能不能做出来"不再是问题时,"该做成什么样"就成了唯一重要的问题。
相关推荐

Gemini 3.7 Flash实测:代码能力暴涨,年底特惠值得薅
Google Gemini 3.7 Flash实测评测,代码质量测试达43.6%反超Sonic 5,软件工程测试跃升至65.3%。年底特惠期输入仅0.75美元/百万Token,适合中小团队批量调用。同日OpenAI接入Cerebras芯片实现14倍提速。

AI支出鸿沟:1%企业重仓投入,多数公司仍在花"午餐钱"
基于Ramp AI Index数据,头部1%企业将AI视为刚性运营支出大举投入,而中位数企业的AI支出仅相当于午餐钱。本文解析企业AI支出分化的原因、背后的能力鸿沟,以及对中小企业的实操启示。

四足机器人Sim-to-Real Gap:仿真与现实差距的原因及解决方案
深入分析四足机器人Sim-to-Real Gap问题,从物理参数失配、传感器噪声到执行器动态,解析仿真到现实的鸿沟成因,并介绍域随机化、系统辨识等缩小差距的实用方法。