首页
学习
活动
专区
圈层
工具
发布
社区首页 >专栏 >我用 WorkBuddy 调度本机 ComfyUI 出片:把 AI 短剧的视频生成做成"零成本批量流水线"(含耗时实测与踩坑)

我用 WorkBuddy 调度本机 ComfyUI 出片:把 AI 短剧的视频生成做成"零成本批量流水线"(含耗时实测与踩坑)

原创
作者头像
用户12778060
发布于 2026-10-01 09:07:19
发布于 2026-10-01 09:07:19
400
举报

第 3 篇 | 标题:我用 WorkBuddy 调度本机 ComfyUI 出片:把 AI 短剧的视频生成做成"零成本批量流水线"(含耗时实测与踩坑)

我用 WorkBuddy 调度本机 ComfyUI 出片:把 AI 短剧的视频生成做成"零成本批量流水线"(含耗时实测与踩坑)① 点这里复制标题

② 鼠标在下面正文任意位置点一下 → 按 Ctrl+A → 按 Ctrl+C; ③ 去社区编辑器按 Ctrl+V; ④ 图片若没跟过去,从文件夹 shots_pack\第3篇_本地管线 里按顺序拖 4 张进来。

写在前面

做 AI 短剧,视频生成是唯一的大头成本。云端按次付费的模型,一条 8 秒镜头就是一次开销;而一次就过的镜头在我这儿几乎不存在——试跑、调机位、改表演方向、换种子重滚,一条镜头试三五版是常态。算下来,钱不是花在"成片"上,是花在"试错"上。

所以我做了一件事:把"试错"搬到本地。

现在的分工是这样:

  • 本机跑视频模型(不联网、素材不出机器、无限次、零边际成本)负责所有试跑、验人物、验表演方向、批量重滚;
  • 关键镜头、需要画质上限的,再用云端模型上最后一遍;
  • WorkBuddy 当"导演+工头":改提示词、组生成图、提交任务、盯落盘、抽帧质检、记台账,全链路脚本化。

这套管线跑通之后,我的单条试跑成本从"一次付费调用"变成了"3 分钟电费"。下面是完整做法。

一、输入材料

材料

说明

逐镜提示词 Markdown

每镜一条,含分秒动作时间轴、机位、光线、音频段——唯一事实源,脚本直接解析它,不手抄

参考图(人物 / 场景 / 道具)

锁角色一致性用;没有参考图的人物绝不进画面

音色样本 wav

每个角色一份定稿音色样本,挂进生成图做音色锁

首帧 / 中段 / 尾帧控制图

需要精确走位或运镜时,用 3D 软件先渲出关键帧当控制图

生成记录 JSON

断点续跑用:已成功的镜头跳过,中断后不用重来

【配图:输入材料清单(剧本/素材/生成记录JSON)—— 发布时拖入】

提示词与素材目录

二、WorkBuddy 配置

  • 自建技能(管线接管包):把硬件事实、耗时实测表、参数规则、历史踩坑、脚本清单全部写进一份技能里,触发词设成"本机出片 / 本地跑视频 / 批量跑镜头 / 成本核算"。每次开工它自动带上这些事实,不会给我一个"乐观的耗时估计"。
  • 量产 runner 脚本:由 WorkBuddy 生成并维护,参数从提示词文件里读,一条跑完确认落盘再提下一条(原因见踩坑第 2 条)。
  • 项目记忆:记录"本地跑什么、云端跑什么"的分工表,避免我一时兴起的决策漂移。
  • 自动化任务:每天固定时间提醒我关闭本地服务释放显存(不生成时挂着会越来越慢)。

【配图:WorkBuddy 配置页截图(自建技能/自动化任务)—— 发布时拖入】

批处理脚本结构

三、操作步骤

步骤 1:启动服务并探测就绪

本地视频服务用 HTTP 接口驱动,不需要打开任何图形界面。启动后台服务后先探测就绪(返回 200 才算就绪)。

这里有个容易把自己坑死的地方:首次启动要加载几十 GB 的模型,实测约 3~6 分钟才开始监听端口——探测循环太急就会误判"起不来"。另外如果探测返回 502,通常是系统代理拦截,不是服务挂了,探测请求要绕过代理。

步骤 2:组装生成图(API 格式)

不用打开网页 UI 拖节点,直接以 API 格式提交工作流图:

  • 分辨率与帧数按公式换算(帧数与时长有硬上限,超了画面会崩);
  • 参考图分槽接入,提示词里用标签按序号点名,序号按类型各数各的;
  • 音色样本单独走一个音频加载节点接进"参考音频槽"——这一步决定了角色开口的嗓子,详见踩坑第 4 条;
  • 首帧 / 中段 / 尾帧控制图按需接进对应输入。

【配图:ComfyUI 工作流节点连线图 —— 发布时拖入】

ComfyUI工作流节点连线图

步骤 3:提交、监控、落盘

提交后监控队列,成片自动落到输出目录。监控有两条纪律(都是实翻车换来的):

  1. 盯文件系统,不要只盯任务状态接口——接口轮询实测会漏报(任务明明成功了,循环一直看不到,假超时 10 分钟);
  2. 文件出现 ≠ 写完了——我有一次在服务写一半时抢跑拷贝,拿到一个截断文件。修法是尺寸连续两次读取一致 + 最小体积门槛,双条件满足才许拷贝。

步骤 4:抽帧质检

用本地运行环境自带的视频/图像库抽帧(系统 Python 通常没这些库,别绕路装),固定输出:元信息 + 8 帧关键帧 + 音轨 + 电平体检(静音自动报警)。检查项:首帧有人 / 人数对不对 / 人脸与母版是否一致 / 尾帧构图(起身类镜头最容易头部出画)。

步骤 5:导出台账

一条命令重导三份台账,不需要重新跑片:

  • 分镜表:分列"提示词计划值"与"实测人声"两列(两列不同是正常的,混成一列必被追问);
  • 提示词台账:每镜用的提示词与参数;
  • 镜头长度表:每一镜"靠什么撑住"(环境大场面 6~10 秒靠运镜、对白近景 2~4 秒)。

四、产出物

  1. 成片 MP4(自带音轨,直接可剪);
  2. 生成记录 JSON:每镜的种子值必须留档——想复现同一个画面就靠它;
  3. 质检归档:抽帧图 + 电平体检 + 转写文本,逐镜留证;
  4. 三份台账:分镜表 / 提示词台账 / 镜头长度表,交付与复查都用它。

【配图:耗时实测台账截图 —— 发布时拖入】

耗时实测台账

五、我在自己机器上实测到的耗时(写提示词前必看)

规格

实测耗时

5 秒 / 中低分辨率 / 20 步

≈ 2 分钟

8 秒 / 20 步

≈ 3 分钟(实测 179.87 秒)

15 秒 / 中低分辨率 / 30 步

≈ 16 分钟

15 秒 / 中等分辨率 / 24 步

≈ 19 分钟(实测)

15 秒 / 较高分辨率 / 30 步

≈ 25~40 分钟

两条规律:步数 30 降到 20,省约三分之一时间;分辨率翻倍,时间约翻倍。

→ 所以我的硬规则是:任何新镜头上线前,先用最低规格试跑(2 分钟一条),确认人物和表演方向对了,再上高清或云端。不要一上来就烧 19 分钟一条。

六、踩坑记录(6 条,每条都让我多等过一小时)

  1. 别想着用包管理器自己装深度学习框架。我试了国内外四五个镜像源全部失败(有的显示"可用"但实际找不到包)。正解:直接用官方便携版运行环境(自带 CUDA),一步绕过。
  2. 批量连跑会在第 3~4 条崩(动态显存峰值,进程静默消失、没有任何报错栈,典型的显存溢出)。解法:启动时禁缓存换显存余量;正式跑长批次一次只提交一条,确认成片落盘再提下一条。
  3. 台词绝不能嵌进画面时间轴。我有一条 3 句台词的镜头,连烧四版——字幕以综艺样式打在人物胸前,逐字对得上口播。换种子无效、换措辞无效、把所有"字幕/文字/水印"的否定词全删掉也无效。最后定位到:诱发源是"某秒说某话"写在画面动作里这个结构本身。 改法是把时间轴拆成双轨——画面轴只写动作,台词全挪进音频段但保留秒位。改完一次过。
  4. 提示词写了音色标签 ≠ 真的锁了音色。这个坑最贵:提示词里明明写着音色引用,但生成图里根本没有接入音频输入——那句话当时只是文字描述,指向一个不存在的输入,模型就退回用自己的默认音色,而默认音色每次生成都会变。判据只有一个:去生成的图里查有没有那个音频输入接线。
  5. 挂参考音会让整条画面重滚,不是"只改口型"。我做了同种子对照实验:挂音频的版本与底片差异 60%,不挂音频的只有 18%。所以这条路线的正确预期是"重拍",不是"贴嘴"——想清楚再挂,别以为能只微调。
  6. 3D 预演的相机路径要留净空。我用 3D 软件渲控制帧时,绕着主体做 90° 弧线运镜,半径设成和墙距一样,转到 90° 时相机直接嵌进墙体(墙面距镜头 0.1 米),整批控制帧报废。诊断手法:把那面墙设为不渲染再渲一遍,两图对照即定位。

七、这套管线的真实价值

把试错搬到本地之后,我最有体感的变化不是"省钱",而是决策变快了:

  • 以前想"这个机位换一下会不会更好"要算钱,现在直接跑;
  • 以前一条镜头试到第三版就心疼,现在可以老老实实试到对;
  • 因为能无限试,"先用最低规格验方向,再上高清"才真正落得下来。

成本不是被压下去的,是被挪到了正确的位置——把便宜的算力花在试错上,把贵的算力只花在定稿上。

写在最后

本地跑 + 云端上最后一遍,这个组合我认为是个人创作者当下最务实的一条路。真正让这条管线能跑起来的关键,不是显卡,是把每一镜的参数、种子、质检结果都记下来——没有台账,就没有复现,也没有进步。

有问题欢迎评论区交流。

原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。

如有侵权,请联系 cloudcommunity@tencent.com 删除。

目录
  • 第 3 篇 | 标题:我用 WorkBuddy 调度本机 ComfyUI 出片:把 AI 短剧的视频生成做成"零成本批量流水线"(含耗时实测与踩坑)
    • 写在前面
    • 一、输入材料
    • 二、WorkBuddy 配置
    • 三、操作步骤
      • 步骤 1:启动服务并探测就绪
      • 步骤 2:组装生成图(API 格式)
      • 步骤 3:提交、监控、落盘
      • 步骤 4:抽帧质检
      • 步骤 5:导出台账
    • 四、产出物
    • 五、我在自己机器上实测到的耗时(写提示词前必看)
    • 六、踩坑记录(6 条,每条都让我多等过一小时)
    • 七、这套管线的真实价值
    • 写在最后
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档