只需要安装
edit-timeline-studioSkill,把视频、图片、产品素材或者网站地址交给 Agent,再说明语言、风格、比例和大致时长。喝一杯咖啡的时间,它就能自动完成内容分析、脚本规划、镜头剪辑、配音、字幕和视觉引导,最终同时交付成品视频与可继续修改的.timeline工程。
项目名称:Timeline Studio
GitHub 仓库:https://github.com/MartinDelophy/ai-video-editor
在线体验:https://video-editor.ai-creator.top
Skill 安装页:https://skills.sh/MartinDelophy/ai-video-editor
过去,完成一条产品介绍、网站宣传或知识讲解视频,往往需要经历很多步骤:

真正消耗时间的,往往不是某一个操作,而是这些步骤之间反复确认、修改和重新导出的过程。
我们希望把它简化成一件事:安装一个 Skill,然后告诉 Agent 你想做什么。
例如:
请把这些素材剪成一条英文产品介绍视频。
使用自然女声,专业可信但有活力,16:9,时长约 60 秒。
突出产品最有价值的功能,画面保持稳定,
使用关键帧放大、下划线和准确框选引导注意。
最终交付成品视频和可以继续修改的工程文件。接下来,你可以去喝一杯咖啡。
Timeline Studio 的 edit-timeline-studio Skill 会分析素材、理解内容、规划镜头、生成配音与字幕,并根据场景完成自动剪辑。
任务完成后,它交付的不只是一条 MP4 视频,还包括一个完整的 .timeline 工程。
以后想替换一句配音、修改字幕、调整镜头时长、改变画面比例或者重新导出,都可以直接打开工程继续编辑,不需要从头生成。
很多 AI 视频工具的最终结果只有一条视频。
一旦发现配音太快、字幕不准、镜头顺序不合适,或者产品经理临时修改了一句文案,通常只能重新生成。
这会带来几个问题:
Timeline Studio 把可编辑工程作为整个流程的核心。
每次完整的视频任务都会产生两个结果:
project-name.timeline # 可继续修改的工程
project-name.mp4 # 最终成片.timeline 是一个可移植的工程归档,包含项目状态和使用到的媒体文件。
重新导入后,可以恢复:
因此,AI 可以先完成大部分工作,人再进行最后的精细调整。
这不是用 AI 替代创作者,而是让 AI 完成耗时的初剪、整理和同步工作,把最终判断留给创作者。
表面上看,这是“一键自动剪辑”。
但在真正执行时,Agent 并不是简单调用固定模板,而是完成一套专业工作流。
Agent 会先识别任务属于哪一种视频:
不同类型的视频不会使用完全相同的剪辑逻辑。
例如:
只有确定内容类别、目标观众、视频比例、语言和表达风格后,Agent 才会开始规划。
对于图片,Agent 会分析:
对于视频,Agent 会组合分析:
光流主要用于理解运动,而不是单独判断内容。
系统会先确认画面中的对象是什么,再通过光流判断它如何移动,从而区分:
这让系统能够优先选择清晰、稳定、信息完整的片段,并在需要时先稳定画面,再进行跟踪和增强。
Agent 不会分析完就直接修改工程。
它会先形成一份剪辑决策记录:
这样既方便自动执行,也方便后续审查。
对于存在歧义的内容,Agent 会向用户询问真正影响结果的问题,而不是询问素材中已经能够观察到的信息。
很多自动生成的视频会先把画面固定为 60 秒,再把配音强行压进 60 秒。
这很容易产生几个问题:
Timeline Studio 采用相反的方式:先确定自然的声音表现,再根据配音安排画面。
在开始生成前,Agent 会确认:
生成配音后,系统根据真实句子时长和自然停顿规划镜头。
如果目标时间太短,优先缩短文案,而不是粗暴加速语音。
光标到达、下划线出现、框选锁定、画面放大和结果展示,也会围绕对应的语句进行同步。
为了让后续修改真正方便,最新的 .timeline v3 不再把整段旁白保存成一个音频文件。
句子级配音会被物理拆分:
caption-01 → voice-01.wav
caption-02 → voice-02.wav
caption-03 → voice-03.wav每条字幕通过 audioClipId 与对应的配音片段关联。
这样重新打开工程后,可以:
这是一键自动剪辑能够进入真实生产流程的重要基础。
网站宣传是这套 Skill 重点支持的场景。
用户只需要提供网站地址,并说明目标观众、语言、声音和大致时长。
Agent 会先体验网站,而不是直接把首页截下来做视频。
它会建立页面和流程覆盖清单,包括:
如果关键功能需要登录,Agent 会请用户自行在浏览器中登录,不会索要密码、验证码、Cookie 或其他凭据。
无法访问的功能会明确标记为“未验证”,不会根据宣传文案编造产品体验。
在得到授权的页面范围内,Agent 可以通过脚本驱动浏览器完成可逆操作:
它不会自动提交订单、发布内容、发送消息、修改账户资料或执行其他有外部影响的操作。
网页宣传视频中最常见的问题之一,是在每个页面上都画一个矩形框。
框选过多不仅不能突出重点,还会让视频显得机械、廉价。
Timeline Studio 会根据目标选择不同的视觉引导方式:
一段专业的解释镜头通常遵循这样的节奏:
建立上下文 → 引导注意 → 锁定目标 → 静止阅读 → 自然释放画面移动到目标后必须停下来,给观众足够的阅读时间。
我们明确拒绝:
每个镜头最多保留一次有明确目的的相机移动,以及一个主要强调效果。
多媒体时间线中,一个关键问题是:谁负责控制播放时间?
如果直接使用当前视频元素的 currentTime 作为总时间线时钟,当视频在片尾解码发生停顿,播放头可能会被固定在当前片段末尾。
用户看到的结果,就是画面仿佛一直在某一个片段中循环。
Timeline Studio 使用单调递增的时间线主时钟:
Timeline Clock
├── 同步画面
├── 同步配音
├── 同步背景音乐
├── 同步字幕
└── 同步视觉效果视频和音频只跟随时间线,不再反过来控制播放头。
片段时间区间采用 [start, end) 的半开语义,也可以避免在两个相邻片段的公共边界上同时激活两段媒体。
这种底层稳定性不如生成模型显眼,却决定了编辑器能否真正处理长时间、多片段、多音轨的工程。
Timeline Studio 将多种 AI 能力放在浏览器本地运行,包括:
模型采用按需下载和版本固定策略,并通过 Hugging Face 与 ModelScope 双线路镜像交付。
国内环境优先使用 ModelScope,Hugging Face 作为回退。两条线路使用统一缓存身份,切换来源时不需要重复下载相同模型。
本地优先带来的价值包括:
涉及人脸替换、数字人或其他深度合成能力时,使用者必须拥有相关素材的合法授权,不得生成或传播违法、侵权、虚假或误导性内容,也不得将生成结果冒充为真实影像。
通过 skills.sh 安装:
npx skills add MartinDelophy/ai-video-editor \
--skill edit-timeline-studio安装到 Codex:
gh skill install MartinDelophy/ai-video-editor \
edit-timeline-studio \
--agent codex \
--scope user \
--pin v0.9.1安装到 Claude Code:
gh skill install MartinDelophy/ai-video-editor \
edit-timeline-studio \
--agent claude-code \
--scope user \
--pin v0.9.1GitHub Copilot、Gemini CLI、Cursor 等支持 Agent Skills 的工具,也可以从同一个仓库发现和使用这套 Skill。
安装后,不需要学习复杂的剪辑命令。
可以直接向 Agent 描述结果:
请把这个网站制作成一条英文介绍视频。
使用自然女声,专业可信但有活力,16:9,时长约 60 秒。
请先体验网站的公开页面。如果关键功能需要登录,
请让我在浏览器中自行登录。
画面保持稳定,使用真实交互、关键帧放大、
下划线和准确框选突出重要功能。
最终交付成品视频和可以继续修改的 .timeline 工程。也可以直接提供图片和视频:
请自动分析这个目录中的产品图片和演示视频,
剪辑成一条 45 秒的中文产品宣传片。
保留品牌 Logo、包装文字和产品颜色,
使用自然女声,背景音乐不要盖住配音。
最终输出 MP4 和可编辑工程。Agent 会根据任务选择两条执行路径。
对于命令层已经支持的操作,会使用版本化命令检查工程、生成编辑计划并执行 dry run:
npm run agent -- project.inspect /absolute/path/project.timeline
npm run agent -- project.diff /absolute/path/edit-plan.json
npm run agent -- project.run /absolute/path/edit-plan.json
npm run agent -- project.inspect /absolute/path/project-v2.timeline对于 AI 生成、复杂效果、浏览器操作、实时预览等能力,则通过 Timeline Studio 编辑器完成。
Skill 会明确区分两条路径,不会把 UI 自动化描述成完全确定性的无头执行。
“一键自动剪辑”并不意味着用户失去控制。
因为最终保留了 .timeline 工程,所以后续可以继续修改:
第一次生成可以完成大部分工作,后续调整只需要修改相关片段。
不需要重新分析全部素材,也不需要把整条视频推倒重来。
Timeline Studio 会同时检查技术正确性和编辑质量。
结构验收包括:
.timeline 能否重新打开;编辑质量验收包括:
技术上成功导出,不代表它已经是一条专业成片。
我们认为,AI 视频编辑下一阶段的竞争点,不只是生成模型能做出多漂亮的画面。
真正重要的是:
Timeline Studio 想完成的事情,可以概括成一句话:
安装一个 Skill,一杯咖啡的时间得到一条成品视频;保留一个可编辑工程,承接之后的每一次调整。
项目仍在持续迭代。我们欢迎关注浏览器媒体、WebCodecs、WebGPU、ONNX、自动剪辑、语音、字幕、视觉跟踪和 Agent 工作流的开发者参与。
GitHub 仓库:
https://github.com/MartinDelophy/ai-video-editor
其他地址:
如果这个项目对你有帮助,欢迎 Star、提交 Issue,或者分享你最希望自动化的视频制作场景。
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系 cloudcommunity@tencent.com 删除。