海外博主实测DeepSeek:开源模型已可比肩Opus 4.8

资深开发者实测认为DeepSeek V4 Pro已可替代Claude Code,成本仅为其极小部分。
一位长期推崇Claude Code的开发博主,基于运营月入1万美元SaaS产品的实战经验,公开表示DeepSeek V4 Pro的能力已可比肩甚至超越Anthropic的Opus 4.8,而成本仅为Claude Code订阅费的极小零头。他的核心论点是:构建成熟产品所需的模型能力早已具备,开发者不必等待下一代更强模型。DeepSeek的开源harness提供了更强的工具扩展能力,通过接入BrightData网页抓取服务可弥补其联网读取短板。他的最终立场务实:自己仍会使用Claude Code,但对预算有限的独立开发者而言,付费订阅不再是唯一选择,开源方案已足够可靠,顶级AI编程能力的使用门槛正大幅降低。
一个资深开发者的态度转变
一位长期推崇Claude Code的海外开发博主,在最新视频中给出了一个颇具分量的判断:DeepSeek已经足够好,其Pro版本的实际表现可以比肩Anthropic的Opus 4.8,甚至在某些场景下更胜一筹。这个结论之所以值得关注,是因为这位博主并非DeepSeek的拥趸——他过去两年一直将Claude Code奉为最强的编程工具(harness),如今却公开表示"如果预算有限,我不会再付费买Claude Code了"。
他的判断建立在真实的开发经验之上。他运营着一款名为Harbor的内容生成SaaS产品,目前月收入已达1万美元。这款产品最早基于Sonnet 3.5搭建雏形,随后由开发团队做成正式的SaaS,博主本人又在Next.js和Convex上用Opus 4.5重构了整套系统。正是这段横跨多个模型版本的实战,让他对不同模型的实际能力有了清晰的坐标系。

不必等待"下一个更强模型"
博主抛出的一个核心观点是:开发者不应总是在等待下一代模型发布后才动手。他用亲身经历说明——Harbor这款月入1万美元的SaaS,用Opus 4.5就已经完全构建出来了。也就是说,构建一款成熟产品所需的智能水平,早在几个模型迭代之前就已具备。
这个逻辑延伸到DeepSeek上就变得很有说服力:如果DeepSeek的能力哪怕只是接近Opus 4.5或4.8的水平,就已经完全值得使用。"它不需要比这些模型更好,"博主强调,"只要它接近它们,我们就应该用它。"因为真正的瓶颈从来不是模型本身的绝对智能上限,而是能否用够用的能力把产品做出来。
对于DeepSeek V4 Pro(视频中提到该版本在近两周内刚发布),博主给出了更高的评价,认为它"可能比Opus 4.8还要好"。虽然他坦言自己并未仔细对照benchmark数据,这只是基于实际使用的直觉判断,但对一个长期深度使用商业模型的开发者而言,这种一线体感往往比跑分更能反映真实生产力。
开源harness带来的控制感与成本优势
博主在终端里使用的是DeepSeek的开源harness。他的工作流非常简洁:输入DeepSeek命令,系统检查更新后启动web服务器,随后在设置里填入通过platform.deepseek.com获取的API key即可开始工作。
开源带来的最大好处是掌控感和模块化。博主特别欣赏这一点:"因为它是开源的,感觉我对自己在做的事情有了更多控制权。"想添加新技能、新功能,都可以直接写代码集成进去,扩展极为方便。

成本则是另一个决定性因素。相比Claude Code每月200美元的订阅,DeepSeek的API调用成本用博主的话说是"cents on the dollar"(几分钱对一美元的量级差距)。他直言,对于绝大多数开发者来说,用DeepSeek能获得远高于付费方案的性价比。当然他也承认一个小缺点:DeepSeek略显啰嗦,会做"稍微过多的研究",但只要最终结果足够好,过程冗长其实无关紧要。
Harness 在AI工具语境中指的是一套包裹底层模型的工具链框架,通常包含提示词模板、上下文管理、工具调用接口和工作流编排等组件。Claude Code是Anthropic官方提供的闭源harness,用户只能通过订阅使用,无法修改内部逻辑。而DeepSeek的开源harness则允许开发者直接查看和修改代码,例如添加自定义"技能"(skill)模块——本质上是让模型在执行任务时可以调用特定的外部API或脚本。这种架构的好处在于,即便底层模型能力有所不足,开发者也可以通过扩展工具集来弥补,比如本文提到的接入BrightData抓取能力。开源harness的另一个实际优势是成本透明:用户直接调用DeepSeek的API,按token计费,而非按月缴纳固定订阅费,对使用量较低或使用模式不均匀的独立开发者更为友好。
用BrightData给模型"装上眼睛"
博主反复强调的一个关键补充是网页抓取能力。他发现DeepSeek在正确抓取和读取网页内容方面存在短板,因此接入了BrightData的Scraper Studio技能,让模型能够"真正读懂互联网",而不是只拿到质量糟糕的纯文本。
他做了一个实战演示:让模型抓取"glamping Galway"(爱尔兰戈尔韦的豪华露营)的Google搜索结果页(SERP),然后反向拆解那些非目录类网站(排除Airbnb、Booking.com这类OTA平台)的头部玩家究竟是如何排名的。模型给出的分析相当到位——指出排名的核心在于Google商家资料、EEAT信任信号、真实地址与电话、地理实体对齐、通过本地内容建立的话题权威性以及关键词丰富的内部链接,并总结出"on-page优化并非决定性关卡,信任度往往比页面信号更重要"这一SEO老手都认可的结论。

博主提到BrightData提供了新用户25美元的免费额度(视频中给出折扣码ISS25),大致够抓取上万到数万个页面,而对绝大多数人来说很少会超过1万页的抓取量。超出后的计价约为每1000次抓取1美元。这种"高智能模型 + 廉价 + 联网抓取能力"的组合,正是他认为DeepSeek方案真正跑通的关键。
文中提到的 SERP(Search Engine Results Page,搜索引擎结果页)分析与 EEAT 是两个SEO领域的核心概念。SERP指用户在Google等搜索引擎输入关键词后返回的结果页面,抓取并分析竞争对手的SERP排名是SEO研究的基础动作。EEAT则是Google在其搜索质量评估指南中提出的框架,代表经验(Experience)、专业性(Expertise)、权威性(Authoritativeness)和可信度(Trustworthiness)四个维度,是Google判断页面质量的核心信号之一,尤其对健康、金融、法律等"Your Money or Your Life"(YMYL)类内容影响更大。博主演示的豪华露营案例中,模型能够识别出"真实地址与电话""Google商家资料"等属于EEAT信任信号的具体落地形式,说明DeepSeek对SEO领域知识的掌握达到了实用水准,而非泛泛而谈。
结论:Claude Code不再是唯一选项
博主的最终立场颇为务实。他表示自己在生产环境的编码工作中仍会继续使用Claude Code——"我有这个预算,每月200美元换取最好的模型是值得的"。但他想传达的核心信息是:付费Claude Code不再是100%必需的选择。
"两周前我不会这么说,"他坦言,"以前我总是建议大家付费用Claude Code,说它是最好的。但如果我现在预算紧张,我大概不会再付这个钱了。"这种转变的背后,是开源生态终于提供了一个能力接近、成本极低的可靠替代方案。他甚至相当自信地表示,DeepSeek完全有能力独立构建一款完整的SaaS产品,并计划再做一次实测来证明这一点。
对于预算有限的独立开发者和小团队而言,这或许意味着一个新阶段的到来:顶级AI编程能力的门槛,正在从每月数百美元的订阅,降到"几分钱"的量级。
相关推荐

OpenCode 入门到实战全攻略:AI编程工具安装与配置指南
OpenCode 是一款开源 AI 编程工具。本文梳理其入门到实战全流程:桌面端与 WSL 两种安装方式、模型与规则配置、Agent 分类、自定义命令工具、MCP 服务集成及 SQL 复用,助你系统上手 OpenCode。

10美元AI编程套餐怎么选?Go与Code额度对比拆解
DeepSeek涨价后,10美元AI编程套餐Go和Code怎么选?本文按Mimo、千问、DeepSeek V4、Kimi等常用模型逐一对比两家额度,揭示总额度背后的选购逻辑与请求次数口径陷阱。

多LLM对话真能提升任务表现吗?一个严谨实验设计的启示
一位研究者设计了一套严谨的对照实验,试图隔离多LLM来回对话与单向共享、自我精炼等机制的真实增益。本文解析其实验设计、预算核算与三个开放问题,为多智能体研究提供参考。