ComfyUI Prompt Studio:从参考图到可用提示词的工作流

Prompt Studio 是运行于 ComfyUI 的提示词前期制作工作流,自动将参考图转化为多模型适配的图像与视频提示词。
Prompt Studio 是一位 Reddit 用户为解决 AI 图像/视频创作中重复手工劳动而构建的 ComfyUI 工作流工具。它接收一张参考图和简短的创作方向,自动输出针对 FLUX、SDXL、Krea 2 等不同模型定制化的静图提示词,以及结构化的 MiniMax H3 视频脚本,同时完成宽高比自动检测。工具提供 RECREATE(忠实重建)和 DIRECT(自由演绎)两种模式,将图像提示与视频提示作为独立任务分别处理。底层通过 OpenRouter 完成多模态分析,API key 仅存于用户本地,不随公开下载文件泄露。该工具已在 GitHub 和 CivitAI 以 ComfyUI-Prompt-Studio 开源,代表了提示词工程流水线化的行业趋势。
一个解决重复劳动的 ComfyUI 工作流
做 AI 图像和视频创作的人,往往陷入一套固定的手工流程:加载参考图、分析画面、判断宽高比、写详细的图像提示词,再单独写一段视频脚本。这些步骤看似简单,但每次都从头来一遍,既耗时又容易出错。
一位 Reddit 用户分享了他为解决这个痛点而构建的工具——Prompt Studio,一个直接运行在 ComfyUI 内部的提示词"前期制作"工作流。核心思路是:给它一张参考图和一个简单的创作方向,它就能自动产出一整套可直接投产的提示词资产。

它具体能做什么
根据作者的描述,Prompt Studio 的输出覆盖了从静态图到视频的完整链路:
- 可投产的详细静图提示词:不是几个关键词的堆砌,而是结构化、细节完整的描述。
- 针对目标模型的定制化提示:支持 Generic、FLUX、Krea 2、SDXL 等不同模型的提示语法差异。不同模型对提示词的响应方式不同,针对性优化能显著提升出图质量。
- 结构化的 MiniMax H3 视频脚本:直接生成可用于视频生成模型的脚本内容。
- 自动宽高比检测:省去手动判断和设置的环节。
- 静图与视频方向分离:两者可以有各自独立的创作指令,避免重复描述同一件事。
这种设计思路值得关注——它把"图像提示"和"视频提示"当作两个独立但相关的任务来处理,而不是简单复用同一段文本。这符合实际创作需求:一张静态图强调构图和质感,而视频脚本更看重动作、镜头和时序。
RECREATE 与 DIRECT 两种模式
工具提供了两种工作模式,对应不同的创作意图:
RECREATE 模式
用于对参考图的忠实重建。当你想尽可能还原一张参考图的风格、构图和细节时使用,适合复刻或作为二次创作的起点。
DIRECT 模式
当你希望改变参考图、在其基础上做变体或全新演绎时使用。这种模式给了创作者更大的自由度,参考图只作为灵感来源而非严格模板。
这两种模式的划分,实际上回应了 AI 创作中一个常见的分歧:到底是要"精准复现"还是"启发式生成"。把选择权明确交给用户,是比较务实的产品设计。
技术实现与隐私考量
从技术栈看,Prompt Studio 使用 OpenRouter 来完成多模态的分析与生成任务。演示中的配置是以 Krea 2 作为图像目标模型、MiniMax H3 作为视频脚本模型。
值得肯定的一点是隐私处理:作者明确说明 API key 保存在用户本地的工作流中,不会包含在公开下载的文件里。这对于在意密钥安全的用户来说是个重要保证,避免了分享工作流时意外泄露凭证的风险。
工具已在 GitHub 和 CivitAI 上以 ComfyUI-Prompt-Studio 的名称开源发布,感兴趣的用户可以直接获取。
为什么"提示词前期制作"是个好方向
作者在帖子结尾提出了一个开放性问题:有没有其他人也在把这种"提示词前期制作"(prompt pre-production)直接构建进 ComfyUI。
这个提法本身就点出了一个趋势。随着 AI 生成模型能力越来越强,瓶颈正从"模型能不能做"转向"人怎么高效地把想法翻译成模型能理解的指令"。手写高质量提示词是一门需要经验的技艺,而把这个过程自动化、模板化、模型定制化,能大幅降低创作门槛。
把提示词工程从一次性的手工活变成可复用的工作流节点,是 ComfyUI 生态成熟的自然产物。Prompt Studio 这类工具的价值不在于某个单一功能,而在于它把分散的重复劳动整合成了一条流水线——这正是专业创作者最需要的效率提升。
小结
Prompt Studio 是一个针对性很强的实用工具,解决了 AI 图像/视频创作中真实存在的重复劳动问题。它的亮点在于多模型适配、图像与视频提示的分离处理,以及本地密钥的隐私保护。对于经常使用 ComfyUI 的创作者,这类"前期制作"工作流或许会成为标准配置的一部分。
相关推荐

Cursor工程师揭秘:AI协作的真正瓶颈是信任而非模型
Cursor团队工程师深度分享:AI Agent协作的真正瓶颈不是模型能力,而是信任体系。从验证技能、Eval评估到强约束CI架构,揭秘如何让Agent自动合并PR、单月提交近千个PR的完整方法论。

通义千问Qwen3.8 Flash实测:百万上下文三步上手
通义千问下一代架构Qwen3.8 Flash上架阿里云百炼,支持文本/图片/视频输入与百万级上下文。本文拆解其稀疏激活架构,并提供三步实测流程与三大评估指标,教你快速上手。

Claude Code 国内环境一键安装教程:新手快速上手指南
面向0基础新手的Claude Code国内环境安装教程,介绍密钥准备、脚本运行与终端启动的基本流程,并提示第三方安装包的安全与合规风险。