每日AI新鲜事·07月24日早间版:AI直接操控手机与编程变现热潮
每日AI新鲜事·07月24日早间版:AI直接操控手机与编程变现热潮
2026年07月24日早间版 AI新闻速递+热点深度讨论
2026年07月24日早间版 AI新闻速递+热点深度讨论
今天AI圈又有不少新消息,我刷了一早上,感觉有几个方向同时在爆。先把新闻过一遍,后面有个话题我特别想跟你聊。
你说,我看到了,今天素材挺杂的,但有一条主线——AI在往「直接交付结果」这个方向猛冲。
对对对,正好从这儿切入。B站上有个视频最近在Trending,讲的是一个叫Office CLI的项目。
核心问题就是:Codex帮你写完周报、分析完数据,但最后还是得你自己打开Word一页页排版。这个项目直接解决这事儿。
我知道这个,到7月21日还挂在GitHub Trending本周榜,一周涨了4100多个Star,数字不小。
关键是它在没有安装Microsoft Office的环境里,就能生成Word、Excel、PowerPoint三种文件。这对Agent工作流来说是个missing piece。
对,就是那个「最后一公里」的问题。文案有了、数据有了,但还是得人来复制粘贴、调格式、做PPT。
以前大家想的是「AI帮我写内容」,现在进化到「AI直接交付可用文件」,中间那段手工排版的环节应该消失掉。
从产品角度说,这其实是在补Agent的输出格式能力。光输出纯文本是不够的,得输出人们实际工作中能直接用的东西。
而且它不依赖Office本体,这一点挺重要的。Linux服务器、Docker容器里都能跑,这对自动化流水线很友好。
好,说完Office CLI,还有一条挺有意思的——有人做了个纯vibe coding的玩意儿,用闲置手机当红绿灯,实时显示Claude Code的运行状态。
这个我也看到了,绿灯跑着、黄灯思考、红灯报错,吃灰手机直接变成开发仪表盘,创意是真的足。
就是那种「有用没用不重要,但就是好玩」的项目,vibe coding精髓。
但背后有个值得说的点——Claude Code的状态可视化需求本身是真实的。Agent跑起来之后你不知道它在干嘛,这个焦虑很多人有。
然后B站还有两条关于AI测试岗位的内容,挺密集的,讲Pytest加Agent加LLM做自动化测试,还有专门讲Agent测试岗位爆发的。
这说明AI工具链成熟到一定程度,测试这个环节的需求就会显性化。Agent写的代码不一定可靠,得有人、有工具专门测它。
对,而且这俩视频的出发点是就业导向的,「AI时代怎么保住饭碗」这个焦虑被具体化成了一个岗位方向。
说白了就是——不会被AI替代的,是能测试AI的人。这个逻辑很绕,但现实就是这样。
最后一条,GitHub上的Jellyfin,今天单日新增53颗星,总星数5.4万出头。这个老项目了,是个免费开源的媒体服务系统。
Jellyfin这种本地优先、不联网的项目就是有持续生命力。数据主权的诉求在这个时代只会越来越强,跟harper那个离线语法检查器一样的逻辑。
好了新闻就先聊到这儿,接下来我们聊聊今天最火的两个话题——一个是AI直接操控手机帮你在淘宝购物,另一个是AI编程接单变现。我觉得这两个放在一起特别有意思。
我也这么觉得,而且这两个话题本质上是同一件事的两面:AI从「辅助工具」变成「执行主体」。
先说第一个。B站上有个视频互动分将近31000,讲的是让AI直接操作iPhone,帮你在淘宝购物。这个数据相当高了。
是高。这个方向其实业内叫做Computer Use或者Mobile Agent,原理是AI看屏幕截图,判断要点哪里、输入什么,然后真的去操作。
但我第一反应是——这玩意儿稳吗?淘宝的页面那么复杂,弹窗、广告、推荐流,AI能搞定?
这正是核心矛盾所在。现阶段这类演示视频,往往是在比较理想的路径下录制的,真实鲁棒性还差得远。
但你不能因为不够稳就否认这个方向的价值。就像早期的语音识别,准确率很低,但它代表了正确方向。
这倒是。问题是,这件事为什么现在火?Mobile Agent不是新概念,之前也有人做过。
时机到了。多模态模型能力提升之后,视觉理解的精度足够了,再加上现在Claude Code、各类Agent工具已经让普通人感受到「AI真的能执行」,大家对这件事的接受度高了。
也就是说,不是技术突变,是认知门槛降低了。大家见过AI写代码,就更容易相信AI能帮你点购物车。
对,而且「帮我买东西」这个场景太具体了,普通人一下子就能代入,不像「帮我优化代码」那么抽象。
但我有个担心——这类应用涉及账户操作、支付流程,安全边界怎么划?AI误操作买错了东西,或者被页面诱导点了某个链接,责任在谁?
这是整个Agentic AI最大的未解问题之一。业内目前的共识是「人在回路」——关键操作要人确认,但这又破坏了全自动的体验。
所以你会看到现阶段这些演示,往往是有一个确认步骤的。完全无人值守的购物Agent,现在还做不到,至少做不到可靠。
那换个角度——如果你是做这类产品的PM,你会怎么设计这个确认机制?
我觉得可以借鉴自动驾驶的分级思路。低风险操作比如搜索、加购物车,完全自动;涉及支付的操作,必须人工确认。把风险和自动化程度挂钩。
这个框架挺合理的,其实就是「权限分级」。不同操作对应不同的授权层级。
对。而且还有个问题——淘宝、京东这些平台本身不开放标准化的操控接口。AI现在是走「看屏幕点击」这条野路子,平台随时可以反制。
所以这类Mobile Agent要真正规模化,要么平台开放官方API,要么就一直在和反爬机制玩猫鼠游戏。
确实,这不只是技术问题,是生态博弈问题。平台有没有动力开放,取决于这类Agent带不带来增量价值。
好,说完AI操控手机,另一个热话题是AI编程接单变现。B站上有视频说半个月赚了8.9k,新手无负担,这种视频现在非常多。
这类标题我看到就得先打个折扣。但现象本身是真的——AI编程工具确实降低了接单门槛,这一点不用质疑。
对,门槛降低是事实,但「半个月8.9k」这个数字很容易让人误解。不是人人都能复制的。
关键变量是你能不能判断需求、跟客户沟通、做需求拆解。AI帮你写代码,但你得知道让AI写什么,这个判断力不是工具给的。
所以某种程度上,现在用AI编程接单,拼的不是代码能力,是产品理解和沟通能力。
对,反而更像PM的工作了。你要把客户的模糊需求翻译成清晰的任务,喂给Agent,再验收输出结果。这个循环里,人的核心价值是需求理解和质量把控。
这就呼应了刚才说的Agent测试岗位——AI写得越多,验收能力就越值钱。能判断AI输出好不好,这才是护城河。
而且我觉得变现这件事本身在2026年已经不是新奇话题了,有趣的是它开始往下沉——之前是技术人玩,现在视频受众明显扩大了,连「新手无负担」这种措辞都出来了。
是,这说明AI编程工具的易用性确实在快速提升,受众从专业开发者扩展到了更广的人群。
但这里有个风险——大量「会用工具但不懂技术」的人涌入接单市场,交付质量参差不齐,长期对整个赛道是有伤害的。
这倒是个真实问题。客户被坑过一次,就会对这类AI接单服务产生不信任,反而拖慢市场教育。
所以最终筛选机制还是会回到作品集和口碑。工具降低入场门槛,但市场会重新拉高信任门槛。
把这两个热点放在一起看,其实有一条很清晰的线——AI正在从「辅助写内容」变成「直接替你执行」。不管是帮你点淘宝,还是帮你交付代码接单,都是这个趋势。
对,Agent化是2026年最核心的主题。执行能力、工具调用、Multi-step任务,这些在加速落地。今天聊的这几条,包括Office CLI,都是这个大趋势下不同切片。
好,今天聊了不少,从Agent直接交付Office文件,到AI操控手机帮你购物,再到AI编程接单的变现与风险。方向很一致,执行替代在加速。
今天素材挺集中的,不像有些天乱成一锅粥,线索很清晰,聊起来舒服。
那就这样,中午见。
相关推荐
科技前沿Reve 2与Ideogram 4对比:AI图像生成布局控制能力全面解析
深度对比Reve 2和Ideogram 4两款AI图像生成模型在布局控制方面的核心突破,分析精确布局技术路径、实用场景及行业趋势,帮助设计师和创作者把握AI可控生成的新方向。
科技前沿GLM-5.2登顶全球开源模型榜首:前端编码能力领跑业界
智谱AI发布GLM-5.2模型,在Artificial Analysis Intelligence Index评测中登顶全球开放权重模型榜首,同时被评为顶级前端编码模型。深入解析GLM-5.2的突破性表现与开源模型竞争格局变化。
科技前沿AI行业难得的平静日:信息过载时代的冷思考
当AI行业迎来罕见的平静一天,从业者该如何应对?本文从AINews简报出发,探讨高速发展中的喘息节奏、信息疲劳与内容价值的平衡,以及如何利用平静期进行技术深耕和战略思考。