Codex实战:普通人用AI编程做副业变现的完整路径

从对话模型到AI助理:一条清晰的演进脉络
过去两三年,AI工具的更迭速度快到令人目不暇接。回顾这条时间线:2022年底ChatGPT横空出世,随后国内DeepSeek引爆关注,接着Coze、Dify、n8n等工作流与智能体平台相继兴起。再到Manus(俗称"小龙虾")、Genspark等AI助理产品接连刷屏,让人们第一次意识到——给个任务,AI自己就能完成。
ChatGPT基于OpenAI的GPT-3.5/GPT-4大语言模型,采用Transformer架构和RLHF(基于人类反馈的强化学习)技术进行对齐训练,使模型能够以对话形式响应用户指令。Transformer是Google在2017年论文《Attention Is All You Need》中提出的深度学习架构,其核心创新是自注意力机制(Self-Attention),使模型能够并行处理序列中任意位置之间的依赖关系,突破了此前RNN/LSTM只能顺序处理的瓶颈。而RLHF则是InstructGPT论文(2022)中系统化的三阶段训练方法:先用人类标注数据做监督微调(SFT),再训练一个奖励模型(Reward Model)学习人类偏好,最后用PPO算法进行强化学习优化。这套流程让模型不仅能生成流畅文本,还能遵循指令、拒绝有害请求,是ChatGPT从"技术demo"变成"可用产品"的关键。
DeepSeek则是中国深度求索公司推出的开源大模型,其DeepSeek-V2采用了创新的MoE(混合专家)架构,大幅降低了推理成本,在性能接近GPT-4的同时将API价格压低至行业平均水平的十分之一,这种"性价比路线"引发了国内AI应用开发的热潮。MoE架构的核心思想是:模型虽然拥有巨大的总参数量,但每次推理时只激活其中一小部分"专家"网络。DeepSeek-V2将每个Transformer层的FFN拆分为多个小型专家模块,通过门控网络(Gating Network)动态路由,每个token只激活约10%的参数。这意味着模型可以拥有数千亿总参数以保证知识容量,同时实际计算量只相当于一个小得多的稠密模型——这就是DeepSeek能在保持高性能的同时将推理成本压低一个数量级的技术根源。
Coze、Dify、n8n这三个平台代表了AI应用开发的"低代码"层。Coze是字节跳动推出的智能体搭建平台,用户可以通过拖拽式界面组合插件、知识库和工作流来创建AI Bot。Dify是开源的LLM应用开发框架,支持RAG(检索增强生成)引擎和Agent智能体编排。RAG是解决大语言模型"幻觉"和知识时效性问题的关键技术:首先将用户查询通过向量化(Embedding)转换为语义向量,在预先构建的向量数据库中检索最相关的文档片段;然后将检索到的上下文与用户问题一起送入大模型生成回答。这样模型的回答就有了可追溯的事实依据,而非纯粹依赖训练时记忆的知识。n8n则是开源的工作流自动化工具,通过连接数百个第三方服务节点实现业务流程自动化。这些平台的共同特点是降低了AI应用的开发门槛,但用户仍需要理解业务逻辑和流程设计。
Manus是由中国团队Monica.im开发的通用AI Agent(智能体),它的核心特点是"给定目标后自主规划并执行多步骤任务"——比如研究某个市场、制作对比报告、甚至帮你填写表单。与传统对话式AI不同,Agent具备任务分解、工具调用、记忆管理和自我纠错的能力。从技术架构来看,AI Agent与普通对话式AI的根本区别在于其具备"行动循环"(Action Loop):规划器(Planner)负责将复杂目标分解为可执行的子任务序列;记忆系统分为短期记忆(当前任务上下文)和长期记忆(跨会话的经验积累);工具调用层(Tool Use)使Agent能够操作浏览器、执行代码、调用API、读写文件等;反思模块(Reflection)则在执行过程中评估结果、检测错误并调整策略。这种"感知-思考-行动-反思"的循环使AI能够处理需要多步骤、多工具协作的复杂任务。Genspark则定位为AI搜索引擎+助理,能在搜索结果基础上进行深度分析和内容生成。这类产品标志着AI从"被动应答"向"主动执行"的范式转变。
而真正出圈的,是Codex、Claude Code、Cursor这一批AI编程工具。Codex在这里特指OpenAI推出的云端AI编程代理(2025年发布),它运行在云端沙箱环境中,能独立阅读代码库、编写代码、运行测试并提交PR。所谓"云端沙箱"是一种隔离的计算环境,本质上是轻量级虚拟机或容器——每个编程任务在独立的沙箱中执行,与用户的本地环境和其他任务完全隔离。沙箱内预装了常见的编程语言运行时和包管理器,Agent可以自由安装依赖、运行测试、读写文件,但无法访问外部网络或影响宿主系统。这种设计既保证了AI执行代码的自由度,又确保了安全性。Claude Code是Anthropic推出的命令行AI编程工具,直接在终端中运行,擅长处理大规模代码库的理解和重构。Cursor则是一款AI-native的代码编辑器(基于VS Code分支),集成了代码补全、对话式编辑和多文件修改能力。三者的共同趋势是:AI不再只是"代码补全助手",而是能独立完成完整编程任务的"AI程序员"。
有意思的是,Codex能火并不只因为它能写代码。越来越多人开始用它处理身边的大小事务,它已经悄然从一个编程工具演变成了通用的AI助理。

作者坦言自己在探索过程中走了不少弯路:玩小龙虾第一个月花了800美金,一半时间在修bug,另一半在应对"AI突然失忆"。第二个月摸清门道后降到200美金。这段经历带出一个核心观点:不要执着于某个具体工具或模型,真正要关心的是它能创造什么商业价值。
想清楚三个问题再动手学AI
在动手之前,有三个问题值得每个人认真思考。
你想用AI解决什么问题
可以归纳为四个方向:
- 岗位提效:AI+岗位场景让效率翻倍
- 副业接单:下班后多一份收入来源
- 转行就业:借AI完成职业转型
- 创业变现:做自己的产品,成为超级个体
方向清晰,学习才有效率。
你处于AI应用的哪个阶段
这是全篇最有洞察力的框架。AI使用者可以分为五个阶段:
- 第一阶段 尝鲜者:把AI当聊天工具,搜索问题、写文案
- 第二阶段 提效者:用AI干活,写提示词、做表格、批量出图
- 第三阶段 造物主:用工具造工具,做出能跑的网页、小程序、脚本
- 第四阶段 交付者:产品能上线,解决登录、支付、改bug等问题
- 第五阶段 变现者:产品能赚钱,做成一人公司
中国95%以上的人卡在第二阶段——会用AI做PPT、做表格、做选品分析,但仅此而已。第三阶段是转折点,第四阶段是分界线。因为"能跑不等于能交付",真正值钱的价值集中在第三到第五阶段。你学AI能不能赚钱,本质上取决于你走到了哪个阶段。
实战一:五分钟做出一个选品助手
为了证明普通人也能从第二阶段跨越到第三阶段,下面展示两个用Codex开发的真实工具案例。
第一个是电商场景下的选品助手。需求很明确:设定好判断产品价值的权重指标(区分蓝海产品和普通产品),然后对50条商品数据做处理,最终导出一张选品表格。
操作流程相当直接:在Codex中创建一个名为"选品助手"的项目文件夹,输入需求描述,点击运行。整个过程AI在后台自动写代码,无需人工敲一行,大约五分钟就能完成。

成品效果相当完整:导入50条数据后自动分类,展示价格、月销量、评分、评论数、潜力评分等维度,还能一键筛选蓝海数据、导出Excel表格。如果让人手写这近千行代码,得花多长时间?而AI只用几分钟。
Codex版本与模型选择建议
关于工具版本,Codex常用三个套餐:
- Plus:约20美金/月,入门足够
- 5X:约100美金/月,适合中度使用
- 20X:约200美金/月,适合重度开发
对于搞不定环境配置的人,直接接API或中转站就能开干,连月租都省了。API(Application Programming Interface)是软件之间通信的标准协议,在AI语境下意味着直接向大模型服务商发送请求并按实际使用的token数量计费,无需订阅月费。Token是大语言模型处理文本的基本单位,对英文而言1个token大约对应4个字符或0.75个单词,对中文而言1个汉字通常消耗1.5-2个token。API按token计费分为输入token和输出token,输出通常比输入贵2-4倍。以GPT-4o为例,100万输入token约5美元、100万输出token约15美元,一次普通对话消耗几百到几千token,而让AI编写完整项目可能消耗数十万token。"中转站"是国内特有的概念,指第三方服务商批量购买海外API额度后转售给国内用户,解决了支付渠道和网络访问的问题。
不要有"模型纠结症",模型是为你要做的事服务的,只要事情有价值,用什么模型都值。 但要注意:涉及高保密性的内容(如国企、大型企业的机密合同),不要用中转站API,因为你的请求数据会经过第三方服务器,存在数据泄露的可能性。
实战二:一天半做出错题复习小程序
第二个案例更具体,也更有说服力——为读初一的孩子做了一个错题复习助手小程序。
需求从真实痛点出发
孩子的错题分散在各科试卷里,收集难、分类难、还需要举一反三(只做原题等于背答案)。先让AI调研市面上有没有现成产品,得到的结论是:没有一个专门独立的产品能满足需求。于是直接上手开发。

成品包含五大模块:
- 拍照录入:手机拍照即可收录错题
- 举一反三:AI生成同类变式题,避免死记硬背
- 遗忘曲线复习:按"一天、三天、五天、七天、一个月"的节奏复习五遍
- 到期提醒:自动推送复习通知
- 错题打印:方便线下练习
其中"遗忘曲线复习"模块的设计依据来自德国心理学家赫尔曼·艾宾浩斯于1885年提出的遗忘曲线理论:人类记忆随时间快速衰减,学习后1天即遗忘约74%。基于此发展出的"间隔重复"(Spaced Repetition)学习法,通过在记忆即将消退时安排复习,可以用最少的复习次数实现长期记忆。这与Anki等记忆卡片软件的底层算法逻辑一致——Anki使用SM-2算法的变体,根据用户对每张卡片的回忆难度动态调整下次复习的间隔时间。大量认知科学研究已证实,间隔重复的记忆效率是集中复习的3-5倍,特别适合需要长期保持的知识(如错题中暴露的薄弱知识点)。
孩子可以看答案、用AI解答(支持文字和拍照)、标记"会了"跳到下一题;家长模式则能看到所有高频错题的知识点分布,实现学习监督。
从工具到副业的想象空间
这个小程序已经实际使用了一个月。关键问题来了:这东西能不能卖钱? 如果每人每月收10块钱,100个人就是1000块,而且是每月复购。
还有一个真实案例:一位宝妈做了个"儿童身高体重计算器"小程序发到妈妈群,积累了300个用户,每人收5块钱,副业机会就这么诞生了。这说明解决真实痛点的小工具,天然具备变现潜力。
AI编程的本质:氛围式编程与产品思维
应该把"编程"这个词去掉,因为它误导了太多人,让人觉得那是遥不可及的技术活。更准确的描述是**"Vibe Coding"(氛围式编程)**。
这个概念由OpenAI联合创始人Andrej Karpathy在2025年2月首次提出。他描述了一种全新的编程方式:"你完全沉浸在氛围中,拥抱指数级增长,忘记代码的存在。"核心含义是:开发者不再逐行编写和审查代码,而是用自然语言描述意图,让AI生成代码,遇到报错就把错误信息扔回给AI修复。这种方式从根本上模糊了"程序员"和"非程序员"的边界。Karpathy本人是斯坦福大学计算机视觉博士、Tesla前AI总监,他提出这个概念的背景是:即使作为顶级程序员,他发现自己越来越多地采用这种"不看代码"的开发方式,因为AI生成代码的速度和质量已经达到了"审查每一行代码"变得低效的程度。

传统开发与AI编程的根本差异
| 对比维度 | 传统开发 | AI编程 |
|---|---|---|
| 学习门槛 | 学语言、学框架,几个月起步 | 描述需求即可 |
| 编码方式 | 一行行手敲代码 | AI几分钟写完几百行 |
| 报错处理 | 查资料、查文档 | 直接发给AI修复 |
| 核心能力 | 编程工程能力 | 需求拆解与产品思维 |
钉钉负责人曾提出一个观点:未来没有"软件工程师"这个岗位,只有"智能体工程师"。在AI时代,你不再是一块块砖地砌的工人,而是指挥AI干活的"包工头"——你只管要什么。这对文科生尤其是好消息,关键不在于会不会写代码,而在于能否建立产品思维、会不会指挥AI。
四条变现路径:AI时代的办公软件
一个核心判断:AI编程(Vibe Coding)就是AI时代的办公软件。 就像当年不会用Office就找不到工作一样,未来不会用AI做产品,你的岗位竞争力就会下降。
两个内部实践案例印证了这个判断:
- 用两天开发出"绩效助手"上架企业微信,替代了每年5万元续费的第三方绩效考核系统
- 用AI脚本替代10个实习生(每月3万元)手写学生评语的工作
基于同一套能力,可以总结出四条变现路径:
路径一:岗位提效
让你的岗位更值钱、不被淘汰。会开发工具的HR、电商运营,在求职市场上拥有明显加分项甚至硬通货。
路径二:转行就业
做出网页、小程序、APP等全栈作品集上传GitHub,对标初级开发岗位拿offer。GitHub是全球最大的代码托管平台,也是开发者的"简历"——招聘方通过查看候选人的GitHub仓库来评估其实际编码能力和项目经验。全栈(Full-Stack)指同时掌握前端(用户界面)和后端(服务器逻辑、数据库)开发能力。在AI编程时代,"全栈"的定义正在发生变化:你不需要精通React和Node.js的每个API,但需要理解产品从界面设计、业务逻辑、数据存储到部署上线的完整链路,然后用自然语言指导AI完成每个环节。这使得"全栈工程师"从一个需要5年以上经验的高级岗位,变成了AI辅助下3-6个月可达到的能力水平。
路径三:副业接单
在闲鱼、淘宝接单,企业展示小程序约2000-8000元一个,脚本自动化约几百到几千元,门槛不高但收益实在。
路径四:创业变现
成为超级个体或一人公司,从引流、产品到推广全流程用AI完成。超级个体(Super Individual)指借助技术杠杆,一个人能完成传统上需要整个团队才能完成的工作。在AI时代,这种模式变得前所未有地可行:一个人可以用AI处理产品设计、前后端开发、内容创作、客户服务、数据分析等全流程。典型的一人公司商业模式包括SaaS微产品(月费订阅制)、付费工具(一次性买断)、自动化服务(按次收费)等。SaaS(Software as a Service)即软件即服务,"微SaaS"特指由个人或极小团队运营的、聚焦某个垂直细分需求的产品,其典型特征是开发成本低(几天到几周)、目标用户精准、运营成本极低(云服务器月费几十到几百元)、收入可预测(订阅制带来稳定现金流)。一个月收费10-50元、拥有几百到几千付费用户的微SaaS,就能产生每月数万元的被动收入。全球已有大量案例证明,一个人借助AI工具链可以运营年收入数十万甚至百万美元的产品。
每个时代都会重新定义"谁更值钱":农业时代的地主匠人、工业时代的工程师技师、互联网时代的程序员产品经理,而AI时代的关键词是AI Native、提示词工程师、上下文工程师、Builder、超级个体。而且节奏越来越快——农业时代数千年、工业时代两百年、互联网时代三十年,AI时代的变化要按周来算。
结语:能跑不等于能交付
这份分享最有价值的地方,不在于教你怎么点击Codex的按钮,而在于它清晰地指出:学AI最大的误区是执着于工具本身,真正的分水岭是你能否用AI做出有商业价值的结果。
现场演示的demo距离真正能上线赚钱的产品还有距离——第四、第五阶段还需要掌握部署上线、安全防护、登录支付、获客变现等能力。
但无论如何,从"会用AI聊天"到"用AI造出真产品",这一步的跨越比想象中容易得多。对于中国95%还卡在第二阶段的人来说,这或许正是最值得迈出的一步。
相关推荐

Vercel Zero:专为AI智能体设计的编程语言详解
Vercel发布实验性编程语言Zero,用语义程序图取代传统源代码文本,让AI智能体直接操作结构化图而非编辑字符串。深入解析Zero的核心理念、Token效率优化及对编程范式的深远影响。

OBLITERATUS开源项目走红:AI大模型越狱攻防博弈解析
GitHub热门项目OBLITERATUS获7900+ Star,汇集大模型越狱提示词技术。本文深入解析AI越狱原理、常见手法、红队安全研究价值及行业防御启示,探讨对齐安全的动态博弈现状。

谁该为源代码可用性买单?开源可持续性的经济学困境
探讨开源软件源代码可用性的成本承担问题:从维护者倦怠到商业公司责任,分析企业赞助、基金会供养、新型许可证等路径如何解决开源生态的可持续性难题。