WorkBuddy 入门5:每天领的 100 积分怎么花?教你用内置专家零成本剪视频
今天有朋友在群里问我,那条讲微信剪藏的视频是怎么剪出来的。
我当时正在下班路上,随手回了一句,用 WorkBuddy 剪的。
说句心里话,这条片子里真正需要我自己动手的地方很少。大部分时间我是在跟它说话,说我要什么,说这个位置不对,说改回上一版。
趁着手感还热,我把整套流程梳理一遍,看看我在 WorkBuddy 里面是怎么把这条视频剪完的。
出镜之前,先把背景做出来
说实话,我不太想对着一面白墙干讲十分钟。
出镜之前,我得先把背景动画搞定。这一步用了我之前写的一个 Video Background Skill,做法很简单,把前阵子写的Obsidian 入门 78整篇丢给它,让它自己去读。
它直接帮我写出了一个用于口播的动态网页背景,左边是微信绿,右边是 Obsidian 紫,中间是一套随着讲解内容流动的动效。
背景具体长什么样,用文字描摹其实挺费劲,不如直接看图或者去网页里瞄一眼。我把它挂在了个人主页上,直接打开就能看。
https://xiaoweibox.top/chats/clip2md-wechat-clip-intro.html

整个过程我完全不需要写代码,就是把文章丢过去,让它看着办。
录制的时候,我拆成了三段
以往我的习惯是一镜到底录完再剪,这次却不行。
因为讲到一半我要去手机上演示操作,手机弄完又要回到电脑,画面需要来回切换。如果一口气硬录,镜头一断,后面全得重来。
所以我干脆拆成了三段。
第一段对着刚刚那个背景讲大纲,讲到该拿手机的地方就停,五分半,横屏。用的是 Screen Studio。
第二段是在手机上操作,录下 CLIP2MD 剪藏助手收到剪藏工单并点开看内容的过程,用的是手机自带的录屏,三分五十五秒,竖屏。
第三段回到电脑,演示在 Obsidian 里搜索并安装插件的完整步骤,五分二十秒,横屏。

三段加起来十四分四十八秒。录的时候挺顺,但代价留给了剪辑。
两段横屏夹着一段竖屏,比例完全不同。这样录并不算什么常规做法,纯粹是为了保住每一段画面的稳定而做的妥协。
把它交给 ChatCut
在 WorkBuddy 左侧的专家列表里选 ChatCut 视频剪辑师,第一次用简单授权连接一下(按照提示登录就好),后面就能直接对话,我选择的模型是 Deepseek V4.1 flash。

我把这三段素材丢进一个文件夹,告诉它我的目标。
它没有急着动刀,而是先给素材做了一次体检,把三段的分辨率和规格列出来,接着问了我一个关键问题,画布要什么比例。我当时没太当回事,后来才明白这一步有多重要。画布尺寸如果不提前定死,后面所有元素摆位全得返工。
我选了十六比九横版,目标时长定在八到十分钟。
接下来的第一轮粗剪,也是它下手最狠的一轮。它一口气清掉了口播里所有「呃」、「啊」这类气口填充词,一共八十一处;同时把句与句之间过长的无效停顿全部压短,两百四十三处。
原本十四分四十八秒的素材,眨眼间被压缩到了十二分四十二秒。
没想到剪了这么多,原先我还觉得自己录得挺利索。
后面两轮是我跟它一起过的。哪些话说得啰嗦,哪两句话可以合并,这类判断它会给建议,但我会盯着时间线逐条确认。两轮对齐下来,时长压到了十分零二秒。
至于成本,我自己的体验是这一步完全没有额外消耗 ChatCut 的积分。虽然会员会有一些进阶特效,但日常用来精简口播、压停顿和排字幕,免费基础能力已经完全管够。
而且搭配每日领的赛博鸡蛋:WorkBuddy 100 积分,完全够用了!
如果还不知道怎么自动领取 WorkBuddy 积分的话,可以查看这篇往期文章WorkBuddy 入门4:让 AI 替我每天领 100 积分
字幕是这次最省事的一环
粗剪完之后,第一件事就是过字幕。这直接决定了后面哪些画面和关键信息能留得住。
整体识别率很高,唯一的盲区是专业英文名词。像 WorkBuddy、Codex、Claude Code,还有 Obsidian,这几个生词它几乎无一例外全认错了。毕竟是这两年才冒出来的新工具,倒也情有可原。
好在改起来完全不用跳出工作台。在网页预览界面里,直接点中那张字幕卡就能改,改完实时生效。整部片子三百四十多张字幕卡,我真正上手纠错的也就十来处。
字幕字体选的是「得意黑」,也是它自动帮我选的。配合深色圆角底卡,正好跟前面那套动效背景的调性融在一起。
顺手加的几笔
除了剪辑和字幕,画面上它还顺手做了几处很有意思的细节,也都是直接靠代码渲染出来的。
第一处是纸感便签的高亮圈注。每当讲到核心关键点,画面一侧就会弹出一张米色便签,像用马克笔随手把关键词圈出来,位置刚好避开人脸。

第二处是竖屏素材的画幅兼容。手机录屏直接塞进十六比九横屏肯定会有大块黑边,它给配了一条同色系的侧栏,把多余黑边自然转化成了视觉版面。

转场音效一共铺了九处,全卡在章节切换和落点节奏上。音量压得非常克制,属于不戴耳机特意听几乎觉察不到、但有了就会觉得画面很踏实的衬底。
封面用的是我自己改的那一版
封面用的是我之前写的另一个封面生成 Skill。
素材来得很随性。我打开电脑自带的摄像头抓拍了几张,挑了一张表情最自然的丢进模板。它在本地自动抠出人像、做磨皮和光影微调,然后按三比四和四比三分别输出了一版。

回头看,真正需要我的只有三件事
说清楚我到底要什么。
判断给出来的版本对不对。
以及按下录制键。
剩下的脏活累活全被它接管了。三段碎素材丢进去,吐出来一条十分十九秒、带字幕、带动效、带音效的完整成片。
我觉得现在做视频,最难点反而是在最开始的成片录制;后面的剪辑反而是一件简单的事情。
以前,录视频是个难点;录完之后剪视频又繁琐、枯燥,但又是不得不做的事情。一些好的效果,还得开剪映会员,甚至不得不去学剪辑课程。
所以,阻碍你的只是行动。你只要先动起来,把视频录下来,后面交给 AI,它总能给你剪出可以用的版本。