从 PaperCut 到 Codex/ChatGPT 插件,ChatCut 正在做通用 Agent 背后可靠可编辑的视频执行层


从 PaperCut 到 Codex/ChatGPT 插件,ChatCut 正在做通用 Agent 背后可靠可编辑的视频执行层
MaxClaw接入微信只需三步:添加weixin-connect技能、输入指令获取二维码、扫码配对,支持语音互动和多账号部署
ChatCut 是一款 AI 视频剪辑产品,创始人 李凯文(Kaiwen Li) 是前 VICE、Discovery 广告纪录片导演,短片《猎种》曾入围金马奖。它最早解决的是纪录片/真人秀/播客创作者最痛的一刀——扒采访文字稿、找金句、调顺序、组织故事的粗剪。经过一年半演进,它的定位发生了关键迁移:从「一个独立的剪辑应用」变成「通用 Agent 背后的专业视频执行层」。2026 年 7 月,ChatCut 上线了 Codex 和 ChatGPT 插件,意味着你可以在通用 Agent 里用自然语言描述意图,由 ChatCut 负责把它变成可检查、可修改的视频工程。
理解 ChatCut 现在的价值,要先看它怎么一步步走到这里。竞争单位(用户付钱买的最小颗粒度)一直在变:
| 时间 | 产品阶段 | 竞争单位的变化 |
|---|---|---|
| 2025-02 | PaperCut | 时间线 → 可编辑文字 |
| 2025-09 | 对话剪辑 | 显式操作 → 自然语言控制 |
| 2025-11 | AI 生成 MG | 重组素材 → 生成新视觉 |
| 2026-02 | 通用剪辑 Agent | 单个功能 → 完整多步骤任务 |
| 2026-07 | Codex / ChatGPT 插件 | 独立应用 → 通用 Agent 背后的专业执行层 |
纪录片、真人秀、播客有大量采访素材,导演要扒文字稿、找金句、调顺序、组织故事。ChatCut 1.0 的界面是左边 Bin Viewer、右边 PaperCut:在源文稿里选句、标记、划除、排序,视频跟着文字变化,可导出 Premiere 和 DaVinci Resolve 的 XML 回专业软件精修。它只切一刀,但切的是最费脑、最重复的那一刀。
2025 年 9 月起,从「用文字剪视频」变成「让剪辑像聊天」。一次导入三段长视频,直接描述故事结构,AI 返回计划并把片段写入时间线。聊天框没有替代编辑器——文字稿、时间线、拖拽、字幕、音频、XML 都还在。对话负责表达意图,编辑器负责暴露状态,人负责验证和精修。
2026 年 2 月的录屏里,它能完成一条完整链路:抓取 YouTube 失败后自动改用 media downloader,再抽帧、读逐字稿、抓网页、分析风格、制定分镜、生成素材,最后写回时间线。软件不再等用户点按钮,Agent 围绕目标拆步骤、选工具、处理失败、交付可继续编辑的工程。
2026 年 7 月 ChatCut 上线 Codex 和 ChatGPT 插件后,入口外移——用户先在通用 Agent 里输入目标,Codex 展示内容和剪辑判断,通过 ChatCut workflow 把切点、MG(动态图形)、音乐、音效写进时间线。
有创作者在 Codex 里实测了一轮,绝大部分工作通过对话完成:
💡 提示:ChatCut 的核心取舍是「做到 80% 但给人留下修改空间」优于「做到 90% 却不让人改」。在通用 Agent 里生成视频后,务必回到时间线人工过一遍气口和转写,这是当前 AI 视频剪辑的通用短板。
一个反直觉的判断:入口被通用 Agent 分流,不等于专业能力失去价值。恰恰相反——Agent 承接的任务越复杂,背后越需要可靠、透明、可编辑、可交接的执行层。
李凯文给专业软件划了一条新护城河标准:
代价当然存在:如果用户只记得「我在 ChatGPT 里剪了视频」,用户关系、品牌心智和议价权可能被通用 Agent 拿走。ChatCut 接下来要证明的是——能否比其他执行层更可靠、更可控、更懂工程。