剪视频不用来回切软件了:ChatCut 把整条时间线塞进 ChatGPT
2026年7月13日 · 2490 字 · 5 分钟 · ChatCut ChatGPT插件 AI视频剪辑 视频创作 AI Agent

最近一个自动剪视频的项目比较火,可以通过对话直接剪口播等,以后剪一条视频,可能不需要先学会几十个按钮。
你只要告诉 AI:删掉口头禅和停顿,找出最有信息量的 60 秒,改成竖屏,加字幕,再补一段 B-roll。
剩下的活,它直接在时间线上替你做。
最近看到的 ChatCut 插件,就是沿着这个方向往前走了一步。它把视频剪辑能力接进 ChatGPT/Codex,让 Agent 不只给建议,还能导入素材、修改时间线、生成字幕和动画,最后导出成片。
先说我的判断:ChatCut 最值得关注的地方,是把“聊天”和“可继续编辑的时间线”接到了一起。 单独增加几个 AI 生成功能,反倒没那么稀奇。
这可能才是 AI 剪辑真正好用的形态。
它到底能做什么
ChatCut 原本就是一款网页版 AI 视频剪辑工具。官方文档显示,它目前更擅长口播、访谈和长视频切短等场景,可以根据转录内容理解素材,再完成粗剪、找高光、删片段等操作。
接入 ChatGPT/Codex 后,常见工作可以直接用自然语言发起:
- 导入自己的视频、录屏或播客素材
- 删除口头禅、静音和无效片段
- 从长视频中提取高光,改成竖屏短视频
- 生成逐字字幕,并调整样式和时间
- 添加标题卡、角标、数据图等 MG 动画
- 生成 B-roll、图片、旁白、音乐和音效
- 调整多轨时间线并导出视频
关键在最后两步。
很多 AI 视频工具交付的是一段已经“烤死”的成片。哪里不满意,只能重新抽卡。ChatCut 保留了可视化时间线,你可以继续让 Agent 修改,也可以随时进入编辑器,亲手调整片段、字幕和动画。
AI 负责第一遍重活,人负责最后的判断。 这比让模型一次性猜中全部审美靠谱得多。
工作流变了
传统剪辑软件的基本逻辑,是人先学会软件,再把创意翻译成按钮、菜单和参数。
想删停顿,要找波形;想做字幕,要转录、校对、套样式;想加动画,还得继续研究关键帧。
ChatCut 把入口换成了“目标”。
你可以直接描述结果:
把这段 20 分钟的访谈剪成 60 秒竖屏视频。保留最有冲突的观点,删除口头禅和长停顿,前 3 秒先放结论,加醒目的逐字字幕,再补两个和内容匹配的 B-roll。
Agent 再把这个目标拆成转录、筛选、剪切、排版、补素材和导出。
这个变化对普通创作者很实际:以前卡在“我知道想要什么,但不知道软件里怎么做”;以后更重要的能力,是能否把受众、节奏、重点和成片标准讲清楚。
会用剪辑软件依然有价值,只是大量重复操作开始被 Agent 接管了。
3 类人最适合
1. 口播创作者
一段十几分钟的口播,创意可能只占一小会儿,删废话、压停顿、做字幕和补画面才真正磨时间。
这些工作规则明确、重复度高,正适合交给 Agent 先跑一遍。创作者把时间留给选题、表达和最后审片,收益会比较直接。
2. 播客和访谈团队
ChatCut 官方文档明确提到,它当前的素材分析以转录为主,口播和访谈是优势场景。
如果你经常要把一期长节目拆成多个短视频,它可以先找高光、裁成竖屏、生成字幕,再由人工决定哪些片段值得发布。
3. 小团队和独立开发者
做产品演示、课程预告、功能更新视频时,小团队常见的麻烦是:脚本在一个工具里,配音在另一个工具里,画面生成在第三个工具里,最后还得搬回剪辑软件对齐。
ChatCut 想把生成、剪辑和修改放进同一条时间线。对没有专职剪辑师的小团队,这种“一处完成”的价值,可能比某个模型多生成几秒视频更大。
怎么开始
目前插件面向 ChatGPT/Codex 桌面端,网页端和移动端不能直接安装。官方提供的公开插件仓库仍标注为 Beta,需要 ChatCut 账号、支持插件的 Codex,以及一个可编辑的 ChatCut 项目。
安装思路并不复杂:
- 在 ChatGPT/Codex 桌面端打开一个对话。
- 让 Agent 阅读 ChatCut 的安装页并安装插件。
- 按提示登录 ChatCut,完成授权。
- 在新对话中创建项目,上传素材并描述剪辑目标。
官方给出的中文安装提示词是:
阅读 chatcut.io/chatgpt,帮我安装 ChatCut 插件并创建一个新任务。
插件页面:
https://chatcut.io/chatgpt-plugin
公开仓库:
https://github.com/ChatCut-Inc/agent-plugin
先别急着上头
这类产品很有想象力,但现阶段有 4 个边界需要提前知道。
第一,它还在 Beta。
公开仓库目前只有较少的提交和版本记录,能力、安装方式和稳定性都有可能快速变化。正式项目别把交付时间全部押在它身上。
第二,AI 剪辑依然要审片。
Agent 能识别口头禅和高光,不代表它理解你的全部语境。采访中的限定词、反讽、数据口径和品牌敏感信息,都值得人工重新检查。
第三,生成素材会消耗额度。
截至 2026 年 7 月 13 日,官方提供免费体验;付费页显示月付 25 美元对应 100 credits,月付 100 美元对应 400 credits。不同视频和生成模型的消耗不一样,价格也可能调整,真正高频使用前要先算账。
第四,敏感素材要谨慎上传。
ChatCut 是云端服务。其隐私政策写明会收集账户和使用数据,互联网传输与存储也无法保证绝对安全。未发布商业片、客户保密素材、含个人信息的采访,上传前先确认授权和团队合规要求。
使用建议
如果你准备试,别一上来就让它“做一条爆款视频”。这个目标太虚,Agent 只能靠猜。
更稳的做法是分三轮:
第一轮只做结构。 让它转录素材、找高光、删停顿,先得到一版能看的粗剪。
第二轮处理表达。 明确时长、画幅、前 3 秒钩子、字幕风格和 B-roll 位置。
第三轮人工验收。 检查事实、节奏、字幕、版权和品牌信息,再决定是否导出。
提示词也尽量包含 5 个信息:发布平台、目标受众、成片时长、保留重点、必须避开的内容。
你给的标准越具体,Agent 越像剪辑助理;只丢一句“帮我剪好看点”,它就只能当许愿池。
短评
过去两年,AI 视频工具一直在比赛谁能生成更炫的镜头。
但创作者每天真正头疼的,往往是删废片、找重点、对字幕、补素材和来回改版本。
ChatCut 走的路线更务实:让 Agent 进入一条真实、可回看的时间线,把生成能力和剪辑动作串起来。
它现在还不适合完全替代成熟剪辑软件,也远没到“一句话稳定出片”的阶段。可一旦这类工作流跑顺,未来的剪辑软件很可能都会多一个入口:你先说想要什么,AI 做第一版,人再完成最后那 20% 的判断。
如果你平时要做口播、播客切片、产品演示或 AI 视频,可以先收藏这篇,找一段不敏感的旧素材试一次。
参考资料:
- ChatCut 文档:https://chatcut.io/docs/what-is-chatcut
我会继续拆解真正能进入工作流的 AI 工具,讲清它们能做什么、适合谁,以及哪些宣传词需要打个折扣。==关注我==,少踩坑,也别错过下一波效率工具。
有帮助👉 「点赞」「转发」「小心心」
也欢迎在评论区 灵感流淌!