XYCut:这款闷头做了 3 年的剪辑工作流,我不想说 “全都能”,所以写了这篇文章

前几天,同事发了几条关于视频助手的分享,没想到大家还挺感兴趣。

陆续加了几百个人,都在问软件怎么用。

说实话,有点始料未及。

作为一个沉浸在技术中的 i 人,我的很多消息可能都是意念回复,在这里先给磕一个。

204

当很多人来问我这个能不能做、那个能不能做,我的第一个想法不是说"全都能"。

而是想清楚地告诉所有人,这款工作流能做什么、哪些场景完全不适合。

这篇文章,会告诉你这款工作流到底是什么、怎么用,再帮你判断适不适合你的需求

如果你看完后,发现刚好符合你的需求,那么欢迎来试用。

原本我以为,现在大家都在做口播和 IP,像信息流视频剪辑这种细分需求应该不多,所以从来没对外推广过。

公众号里讲这套逻辑的文章,都是两年前写的。

但现实是,这个需求比想象中普遍得多。

这款从 2024 年开始打磨的工作流,不知不觉已经迭代了 4 个版本

工作流的开发,最初只是为了解决我们自己做旅游获客时的剪辑痛点。

后来也逐渐在其他行业找到应用场景,服务了不少其他行业的视频剪辑需求。

[!note]
接下来,我会从实战案例、版本迭代、工作流介绍、适用人群以及常见问题这五个方面,带你全面了解这款视频助手。


实际案例

下面我们来看一下用这个工作流剪辑的实际案例。

在做旅游获客期间,我们团队日常的信息流短视频,全都是用这套工作流完成剪辑的。

内容就是你可能在抖音、小红书刷到过的那种「几天几晚旅行攻略」视频。

文案生成、AI配音到素材的声画匹配,整个流程全部由工作流自动完成。

实际生产中,一天可以产出几十条这样的视频,效率是纯人工剪辑的十倍以上。

这个产量还是在平衡质量与数量的前提下实现的。

当然我们也不建议完全不做人工审核就批量生产,毕竟现在低质内容很难在平台拿到流量。

得益于精准的声画匹配功能,视频讲到哪个景点,画面就会自动切换到对应景点,最终呈现的效果和人工剪辑几乎没有太大区别。


迭代与更新

大概在 2023 年,AI 刚刚开始普及,那时候 DeepSeek 还没有 Kimi 好用。我们在做 RPA (机器人流程自动化)时,逐步接入了 Kimi 的 API。

在没有 AI 的时代,RPA 只是一个"按键精灵",负责执行固定逻辑。

当有了 AI 之后,原本写死的逻辑就可以交给 AI 处理,既有 AI 的聪明,又有 RPA 工作流的稳定性。

1.0 版本

24 年,我们自己在做旅游获客,需要批量生产信息流视频

当时市场上的混剪工具虽然能快速生成视频,但"声画匹配"问题基本无法解决:声音讲到哪里,画面也要对应出现。

比如做北京旅游视频,讲到第一天落地北京,画面应该是机场;

讲到吃了烤鸭,就出现吃烤鸭的镜头;

讲到去了长城,就切到爬长城的画面。

我们尝试着将完整的文案和素材库分类发送给 AI,让 AI 分析每一句文案讲了什么,和素材库中的哪类素材匹配

AI 相当于月老来牵线,给每一句文案都配上对应的素材标签。

当时用 RPA 操作实现了这套流程,效果一般,但确实比人工快。

那时候的 AI 也还是蛮蠢的,经常分析不正确。


2.0 版本

无意中我们发现,剪映 6.0 版本之前的工程文件没有加密,可以分析视频草稿的组装代码。

那么,如果提前将素材(声音、画面)按要求组装保存到剪映草稿,是不是就可以快速完成视频剪辑?

验证下来确实可行。

打个比方,原本你在剪映中剪辑视频,就像拼积木一样,需要一个一个素材手动组装。

而我们的自动化方式是:提前把组装流程编写好,让 AI 根据文案内容,自动从素材库中找到对应的素材进行组装。

于是我们将"声画匹配"的逻辑进行了开发,通过代码的封装,让 AI 分析文案和素材,实现了剪映草稿的自动生成。

这就是 2.0 版本,一个比较简陋的 demo,但功能已经实现了。


3.0 版本

去年陆续接触了更多的旅游获客团队。除了图文类的笔记,大量的自然获客和素材投流,都需要这种信息流视频。

就是你经常刷到的xx旅行攻略,第一天,哪里哪里,第二天,哪里哪里。

为了让非技术人员也可以使用起来,就必须做到开箱即用。 所以我们将剪映中的非常多的功能接口都设计进来了。

比如你可以直接设置封面、字幕的字体、样式、颜色等等,可以给素材进行放大、动画、转场等等

直到这个时候,我们也没有将工作流作为一个产品对外进行出售。只是去年年底在一个 IP 的会员群中进行了一波推广,积累了几十个外部用户进行测试。

反响还行,也根据不同行业的用户需求优化了很多细节。 但最大的门槛还是上手难度。

工作流使用了一些本地的免费开源模型,用于节省算力成本。

不能本地处理的、需要更好效果的,也要接入大模型平台的 API,对于没有什么电脑基础的小白来说,使用成本还是过高。

这么说吧,要教一个不会正确复制文件路径的用户使用,太难。


4.0 版本

前几天我们的小伙伴发了一些视频进行对外分享。

没想到这种细分领域的需求,还有那么多用户想了解。 陆续加了一些用户,都是想了解软件的。

除了一些做矩阵的"老炮"一听就明白、直接付款之外,绝大多数用户看了好几个介绍视频和成品案例后,对工作流如何用在自己的产品上,还是一脸懵。

他们不知道工作流具体能做到什么程度,担心是不是"割韭菜"。

但因为对小白来说使用门槛高,我们一开始没打算提供试用产品。

结果呢,反而更像在"割韭菜"了。

在 10 个用户有 8 个问有没有试用时,我知道如果再不提供试用版本,做内容的小伙伴就要提刀过来了。

刚好版本进行了大规模的迭代,这几天又取消了原本需要付费的激活限制,添加了一些试用的免费 API,把一些功能开放为免费使用

反正就是,你可以下载试用了。

提前发给了几个不想当韭菜的用户进行了试用,这下效果看得见,付款也就放心了。


工作流介绍

[!note]
视频助手是一款视频自动化剪辑工作流,支持对标视频AI创作和视频自动化剪辑两大核心功能。

对标视频AI创作
① 视频去水印 ② 视频文案提取 ③ 文案AI创作

视频自动化剪辑
① 音画匹配剪辑 ② 口播匹配剪辑 ③ 其他实用功能…

简单说,就是帮你搞定“做什么”和“怎么做”的问题。


核心逻辑

让声音和画面精准对应的「声画匹配」,这是视频助手和市面上批量混剪工具最大的区别

我们按剪辑师的逻辑来组装视频,所以上手有一点门槛:你得先准备好素材

就像不给剪辑师拍好素材,再好的剪辑也是白瞎;素材太差,再牛的剪辑也没法’屎上雕花’。

正常剪辑一条产品视频的流程:

写好文案 → AI配音或录好声音 → 根据内容添加对应的素材画面

视频助手的工作流,也是这个逻辑。

你把文案复制给它,它会通过AI朗读或克隆你的声音完成配音,然后自动让AI分析文案内容,去素材库中精准找到对应的素材,完成整个视频的剪辑。

简单说就是三步:

文案 → 配音 → 自动匹配素材

这样做出来的是符合剪辑师逻辑的高质量视频,而不是那种生硬的画面拼接混剪。

文案、声音、剪辑,这是做视频的三大要素。视频助手解决的就是这三个环节的自动化工作流。


① 文案脚本

如果你本身有写文案的能力,或者可以通过 Claude、豆包这些工具生成文案,那完全可以直接拿过来剪辑。

如果想参考对标账号的视频文案,可以使用工作流里的「对标提取创作」功能。

粘贴一条同行的视频链接,它就会自动完成视频下载、文案提取,以及文案的二次创作

特别说明一点,我们没有做那种"一键改写"的功能。

因为每个用户都有自己的内容要求,这不是一个工具能随便完成的。到了2026年,文案才是决定流量的核心,而不是剪辑有多好。

所以我们提供了提示词自定义功能,你可以把自己成熟的内容创作步骤整理成提示词,这样才能真正在实际生产中落地。

你可以精细化地进行文案创作,比如针对开头创作提示词,或者针对标题生成提示词,这些都可以通过不同选择灵活控制。

同时也支持添加任意提示词,来补充你需要的AI创作工作流。


② 配音克隆

视频除了真人录音外,现在用得最多的就是 AI 配音,比如在剪映里进行文本朗读,挑选不同的音色。

视频助手已经对 AI 配音功能做了封装

只要注册豆包的 AI 配音 API 接入,整篇文案就可以直接选择各种音色完成配音,不用再跑到剪映里一个个手动操作。

除了豆包 AI 配音,我们还接入了火山引擎的真人声音克隆接口和 MiniMax 的AI配音接口,任你选择。

录制一段 10 秒钟的真人声音并上传,未来所有的短视频都可以用你自己的声音来配音朗读。


③ 剪辑组装

文案可以用 AI 生成,配音可以用剪映朗读。

但剪辑得一个素材一个素材地看,再一句话一句话去适配,这才是剪辑信息流短视频里最耗时的工作

视频助手工作流的最大价值,就是对视频素材进行高效组装

前面已经把文案转成了配音,这一步会调用 AI 对每一句文案内容进行语义分析,再和本地素材进行匹配,从而达到最重要的「声画匹配」:

让声音和画面精准地一一对应

【视频展示】

比如做潮汕旅游视频,文案讲到南澳岛,工作流就会自动去素材库里调取「南澳岛」的素材;

文案讲到第二天去了广济楼,画面也会跟着切换到「广济楼」的景点素材。

人工要做的,就是前期把产品素材库整理好。素材库怎么搭建,后面会有详细教程。

只要建好素材库,后续视频助手就能自动调取素材。

一次整理,永久可用,除非以后不做这个产品了。

剪辑时,工作流会自动把字幕、声音、画面全部对齐,并且添加背景音乐、音效,还有混剪去重的功能。

细节方面,可以快速选择不同的字幕样式、添加双语字幕,以及设置封面样式、字体、新闻标题。

我们从最初版迭代到现在一直保持的是:

剪辑完成的视频,是同步到剪映草稿箱的,而不是直接渲染成无法修改的成品。

如果有任何精细化的二次剪辑需求,都可以快速进行人工修改,不需要反复抽卡。

你可以在剪映中自由调整:素材替换、智能包装、细节微调及所有剪映功能精剪

想要量产就快速导出,想要精修就慢慢打磨。

数量与质量,完全由你控制!


另外说一下 AI 的费用问题。

这款工作流采用“工作流”的设计逻辑,AI 只负责最核心的分析工作,其他功能全部由代码实现

所以整个 AI 的分析成本非常低,平台赠送的额度完全够用。

只有在 AI 配音或克隆声音这块会产生一点费用。

我们按接入的火山引擎来算,原价 10 万字 45 元,现在活动价更低。

一个 1~2 分钟的视频大概 500 字左右,用 AI 生成的成本也就两毛多钱(100000字45,500字0.22元),10 个视频才 2 块钱

刚开始你可能会觉得自己设置 API 有点麻烦。

但如果我们直接提供现成服务,本质就是套个壳,再赚你 Token 的差价。

那就得跟市面上其他工具一样,按条数收费,一般 1~2 块钱/条。

如果你只是少量使用,用起来确实更方便,但只要用量稍微大一点,成本就直接翻倍了。

当然,我们现在也提供试用功能,内置了一些免费API供你测试使用,无需任何设置,直接就能用。


工作流适合谁

看到这里,你应该已经理解工作流的核心逻辑了。

现在来判断一下,它到底适不适合你的行业和需求。

三个判断标准

① 你需要批量生产视频,而不是偶尔做一两条

比如在线获客、单品带货、实体商家宣传,这些场景都需要持续产出大量视频。如果你只是偶尔做几条视频,手动剪辑可能更快。

② 你有素材,或者能拍摄/下载/AI生成素材

工作流不会自动生成素材,它只是帮你把现有素材高效组装起来。素材库是前提,没有素材库就没法用。

③ 你的视频是纯AI配音旁白,不是真人出镜或真人+AI混合

如果你的视频是真人口播,或者一会真人说话一会AI配音,那这个工作流就不适合了。

另外,如果你是口播视频需要批量添加画中画素材匹配,工作流有也类似的流程支持,具体可以看使用文档或者试用。

满足以上三点,就可以用。

[!note]
如果想看具体的案例,可以联系我拿飞书文档,我们正在整理「100 个行业案例」。


三种不适合的场景

1. 数字人视频

很多用户以为这是做数字人的工具。不是的,我们没有接入任何数字人功能。

2. 实时AI生成视频素材

有用户问能不能给文案自动调用即梦生成画面。理论上可以,但现阶段不现实:

  • 视频生成的成功率不够稳定,10 个画面每个 80% 成功率,最终成功率会很低(10个80%)。
  • 成本太高,一条视频的素材成本可能几十块,我们现在一条视频两三毛。

更实际的做法是:手动用AI生成素材,抽卡到好的存到素材库重复使用,这样成本才能降下来。

比如旅游视频中的大景点航拍,或者产品展示的素材,用AI生成完全没问题。

3. 直播切片视频

有用户想把直播、上课、演讲的长视频进行高光分析自动剪辑成短视频。

这种需求更适合用智能体来完成,比如 Claude Code 或 OpenClaw。后面我也会做这类智能体/Skills,有比较成熟的进展会第一时间同步。


一些常见问题

收费模式与成本

按年买断制,不按条数收费,不限制使用数量

使用你自己的 API 密钥,我们不赚 Token 差价,没有二次收费,成本透明可控。

唯一产生费用的是 AI 配音。

具体:火山引擎官方价 10 万字 45 元(活动价 28 元),一条 1~2 分钟的视频大约 500 字,成本 0.22 元,10 条视频也就 2 块多

和按条数售卖的工具相比,如果你只是少量使用,基本感觉不到差别。但对于做矩阵号日更的团队来说,成本差距就非常明显了。


AI 的算力费用

采用「工作流」设计,AI只负责最核心的语义分析工作,其他功能全部由代码实现,所以 AI 的分析成本几乎可以忽略

主要费用就是 AI 配音这一块,也就是上面说的,一条视频两三毛钱。

第一次使用需要注册火山引擎的API接口,我们提供了详细的教程,跟着操作即可完成。


矩阵的重复问题

做矩阵最怕的就是平台判重,工作流内置了多种去重功能:

  • 自动叠加画中画、水印贴纸
  • 自动放大素材、添加转场和动画
  • 自动切割素材片头时长
  • 可添加入场动画、转场等
  • 随机组合不同素材片段

这套组合拳下来,同一批素材可以产出大量差异化视频。

我们自己运营30+旅游账号日更,用的就是同一批素材反复剪辑,目前没有遇到平台判重问题。


与纯混剪的区别

最大的区别在于声画匹配

纯混剪是随机拼接素材,声音讲 A 画面可能出现 B,很容易被平台判定为低质内容。

我们的工作流通过 AI 语义分析,让声音和画面精准对应,文案讲到「北京」就展示北京的画面,讲到「产品功能 A」就切换到功能 A 的素材。

这样剪出来的视频质量更高,更容易拿到自然流量,也更适合长期运营。


未来更新

目前工作流已经能覆盖信息流视频的完整生产流程。后续会持续优化:

  • 加入纯混剪流程,满足部分用户的需求
  • 一些常用的剪辑功能的添加
  • 考虑走 OpenClaw 小龙虾 和 Claude Code 的智能体来进行AI剪辑,由 AI 完成素材分类和整理
  • 完善整个体系的落地课程,让没有做过矩阵没有素材的朋友也可以实际用起来

有任何需求和建议,都可以直接反馈。我们会根据用户的实际需求来决定优先级。


如何开始

如果你看完这篇文章,觉得刚好符合你的需求,可以按以下方式开始:

免费试用

现在已经开放了免费试用版本,下载安装后可以直接体验核心功能,不需要付费激活。

试用满意再付费,看得见效果再掏钱。

[!note]
视频去水印、视频文案提取、AI创作这些核心功能,现在全部免费了!

获取软件 + 教程

长按扫描二维码添加微信,发送「视频助手」,我会发你:

  1. 工作流下载链接
  2. 飞书知识库(含完整使用教程)
  3. 素材库搭建指南
  4. 行业案例文档

如果你暂时用不上,也欢迎关注我的视频号。

后续我们会测试一些基于智能体的 AI 剪辑流程,如果 Token 成本降到能接受的程度,会及时同步给各位支持我的朋友们。

类别:

没有回应

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注