Voice DNA — 蒸馏博主表达风格
为什么有些博主的视频你一看就想看完,有些看两秒就想滑走?不是内容差多少,是表达方式不一样。
把爆款文章直接丢给 AI 说「照着写」,出来的东西机械、像念稿。拼拼换了个思路 — 不让 AI 直接模仿,而是先把博主的表达方式拆成一份语言风格说明书(Voice DNA),再用这份说明书指导 AI 写内容。
这期以 B 站百万粉博主秋芝 2046 为例,从选素材、拆指纹到验证仿写效果,一口气跑完整个流程。
为什么有些博主的视频你一看就想看完,有些看两秒就想滑走?不是内容差多少,是表达方式不一样。同样的知识点,有的人讲你就困,有的人讲你就越听越上头。让你上头的那个部分,是有规律的,而且这个规律可以被提取出来。
直接丢爆款文章不好使
很多人让 AI 写东西,第一反应是把爆款文章丢进去,说照着这个风格写。拼拼最开始也这么干,结果效果不好 — 写出来有种机械的感觉,不像人说的。明明原博主表达很轻松、很口语,AI 写出来的像在念稿。
换了一个思路:不让 AI 直接模仿,而是让 AI 把博主到底是怎么表达的,拆成一份语言风格的说明书,然后用这份说明书去指导 AI 写内容。
为什么选秋芝 2046
拿秋芝 2046 做例子。他是 B 站上一个 AI 科普博主,100 多万粉丝,有很鲜明的表达特点 — 长视频,非常善于用比喻,辨识度很高。
他发了几十期视频,不是全都能用。有的是广告带货,有的是春晚特别节目。先跑了他的播放情况,从里面拉出 14 期,逐个标注类型 — AI 教程的留,广告类的砍。最终 14 个里选了 7 篇作为样本。
七期视频变五万字
样本选出来之后,第二步是视频变文字。用 YT-DLP 下载音频,通过 Gemini 做语音识别。一个细节:因为视频很长,做法是每三分钟切一段,保证有一定重叠的部分,然后并发扔到 Gemini 里。七期转完之后,五万字的逐字稿,差不多一本薄书的量。
量化一个人的说话方式
拿到文稿之后,用 Claude Code 做分析。一个人的说话方式终究是可以量化的 — 喜欢用长句还是短句、最常用的词是什么、标点怎么打、人称代词怎么用。
分析结果:秋芝平均每句话 27.6 个字,不长不短,刚好是一个自然呼吸的长度。太长显得啰嗦,太短显得急促。
第二个明显特征:代词用「我们」。「我们怎样怎样」、「我们一起来看」,减少了很多说教的味道。还有起手词的模式 —「那」「对吧」「那第二个」「那第三个」,这些语言节奏的特点都可以记下来。
Voice DNA:语言指纹
光有数字不够。把这些内容让 AI 画成了一个语言表达风格的指纹,叫 Voice DNA,像一个身份证一样。在 Git 上找了很多别人的最佳实践,最终提取了一个比较适合中文方案的方式。里面有句长分布、人称代词、语气词、句子开头的模式、特征表达,全部都在 Voice DNA 里。
几个特别有意思的发现:
比喻先行 — 秋芝在讲任何技术概念之前,都一定会先打一个通俗易懂的比方。
翻车也录 — 演示的时候翻车的部分也会录进去,不是所有演示都一次性成功。显得更真实。
禁词表 — 很多博主用的「老铁」「震惊了」「天他了」,他从来不用。AI 整理出了一套禁词表:其他自媒体常用但他不用的词。
草履虫师傅 — 他自称草履虫师傅,用调侃的方式降低用户学 AI 的焦虑。很多博主在制造焦虑,他反而说「这是一个喂饭的教程,连草履虫都能看懂」。
验证:仿写一篇口播稿
Voice DNA 提取完之后,怎么验证效果?让 AI 在网上调研了一个最近讨论比较多的话题 — 新入门的小白该学 Claude Code 还是 Codex。把调研结果用秋芝的风格写成了 3300 字的口播稿。
效果蛮不错。开头就很有特点:「哈喽啊朋友们,我是秋芝,今天我们聊一个很多人私信问我的问题」— 非常口语化。然后按上手门槛、操作深度、定制化、价格、适用场景五个维度分析,最后按秋芝的风格做小结,恭喜大家获得了一套工具选择判断的框架,资料和链接评论区见。
这篇文章发给秋芝,他自己也会觉得是他的逐字稿。
可以换任何博主
有意思的地方不在于 AI 能模仿一个博主去表达,而是现在真的有办法把一个人怎么说话这件事情,变成一个看得见的文档。
把这个流程做成了一个可以反复用的工具。换任何一个博主,只需要在 Claude Code 里说:用这个 skill,比如数字生命卡兹克,帮我把他的表达方式变成 Voice DNA。现在要做的只需要关注网上的热点话题,加上自己的核心观点,再加上调研内容,就可以用爆款的方式,甚至创立自己独有的爆款方式,去写内容。
这个 Voice DNA skill 已经开源在 Git 上,可以下载使用。
来源:EP0021_audio.mp3 · ASR 模型 gemini-2.5-pro(切段并发) · 8:51 原片完整文字版
[00:00] 回来啦朋友们,这期视频看完,你就能学到一套方法,就从任何博主的爆款视频里面,把它的表达密码提取出来,让 AI 用同样的方式帮你去写内容。
[00:09] 那为什么有些博主的视频,你一看就想看完,那有些博主的视频呢,你看两秒就想滑走呢?并不是说它的内容差多少,而是表达方式不一样。那同样的一个知识点,有的人讲你就困,有的人讲你就越听越上头。那让你上头的那个部分呢,其实是规律的,而且这个规律是可以被提取出来的。
直接丢爆款文章不好使
[00:27] 那很多人让 AI 去写东西呢,第一反应就是把这个爆款的文章丢进去,就说照着这个风格写,对吧。我最开始也是这么干的,那结果效果并不好,就通常都是会有一些这个机械的感觉,不像是人说的。明明是一个表达很轻松的、一个口语的口播的博主,但 AI 写出来的就是像在念稿。
[00:47] 那怎么办呢?就是我会换了一个思路啊,就是不让 AI 直接去模仿,而是让 AI 把这个博主到底是怎么表达的,拆成了一份这个语言风格的说明书,然后用这份说明书去指导 AI 去把这个文章写出来。
为什么选秋芝 2046
[01:02] 那今天我们就拿这个秋芝 2046 作为一个例子,我们看看是如何把它的表达方式蒸馏出来的。从这个选素材,然后去拆这个指纹,去验证结果,我们一口气跑完。那同样我也会把这个 skill 去公布在我的,开源在我的 Git 上,大家也可以去下载去使用。
[01:18] 那第一个问题就是,我为什么去选择这个秋芝呢?他是在 B 站上的一个 AI 科普的博主,我也非常喜欢他,他有 100 多万的粉丝了。但他有很鲜明的表达的特点,就首先他也是长视频,然后他非常善于用比喻的方式去表达,而且辨识度很高,当然他的热度也很高。
选素材:14 期里选 7 篇
[01:40] 那它发了几十期的视频,并不是全部都能用的,因为有的视频它并不是在做科普,有的是这个广告带货视频嘛对吧,那有的是春晚的特别节目。
[01:52] 首先我在做这个 skill 的时候,就是先去跑了他的这些视频的播放情况,从里面拉出了 14 期的视频,那逐个的去标注了它的类型。然后关于 AI 教程的那我就留,那关于一些特别活动或者广告类的呢,那我就砍掉了。最终 14 个里面选择了七篇,我认为是还不错的,那作为这个样本去学习。
视频变文字:七期五万字
[02:16] 那把这个样本选出来之后呢,我们做的第二步就是把这个视频变成文字。那看过我之前的视频的朋友们就知道,就是这七期的视频我就可以用这个 YT-DLP 去下载它的这个音频,那通过 Gemini 的这个模型呢,可以把这个语音识别转成文字。
[02:38] 那一个小的细节跟大家说的就是,因为它的视频很长嘛,我的做法是每三分钟切一段,而且保证它有一定重叠的部分。这样的话,把它并发扔到这个 Gemini 里面去。那我这七期转完了之后,有五万字的一个逐字稿,差不多就是一本薄书的这样的一个文字的量,这就是我们接下来分析的这个原材料。
量化说话方式
[02:57] OK 那我们就继续,我们拿到了这个文稿之后呢,我们就用 Claude Code 去做这个分析了。那这里面怎么去找规律呢?就一个人的说话方式它终究是可以去量化。比如说喜欢用长句还是用短句,最常用的词是什么词,标点怎么打对吧,它的人称代词是怎样的,那我这个逐个都做了分析,Claude Code 去做的。
[03:23] 比如说分析的结果出来,看到是说它平均每句话是有 27.6 个字,不长不短,刚好是一个自然呼吸的一个长度。太长就会显得啰嗦嘛,太短显得很急促。
[03:31] 那第二个比较明显的特征是说,它用的代词是我们,就是我们怎样怎样,它就减少了很多的说教的味道,永远是我们一起来看。这个有可能是它的一个说话方式,当然也有可能是刻意这样去做的。
[03:45] 那它也会有一些起手词,比如说那,对吧,那第二个,那第三个。就是它的这些语言节奏的这个特点也可以把它记下来。
Voice DNA:语言指纹
[03:55] 光有这些数字不够,对吧。那我把这些内容呢,就是让 AI 去画了一个这样的一个性格的、语言表达风格的一个指纹。它就像一个身份证一样,那我把它这个最终做出来的这个结果啊去给大家呈现一下,对,是这个,这个叫 Voice DNA。
[04:18] 那这个也是在 Git 上面去找了很多就是别人的最佳实践,然后最终去提取了一个这个比较适合这个中文方案的这样的一个方式。大家可以看到这里面的句长分布啊、人称代词啊,包括这个语气词,然后句子开头的模式,对吧,还有一些特征的表达,全部都在这个 Voice DNA 里面。
[04:41] 那这个就是我们给到机器学习完了之后,它的这样的一个语言风格。
秋芝的表达特点
[04:47] 那这里面的话,其实有几个特别有意思的点。第一个是说,秋芝在讲任何的技术概念之前,它都是比喻先行的,都一定会去打一个通俗易懂的比方。
[05:00] 然后第二个是说,他在演示的时候,他的翻车的部分他也是会录的,并不是说他所有的演示都是一次性成功的。那这个其实也是蛮有意思的一个点,就显得更真实。
[05:10] 然后他还有一个特点就是,很多博主用到了那种这个老铁,或者是震惊了、天他了,这些表达他从来都不用的。那我们也是让 AI 整理出了一套禁词表,就是其他自媒体常用的词,但是他不常用的。
[05:25] 然后他还有一个比较有趣的特点,他自称是草履虫师傅,就是去从一个反向的一个角度,非常调侃的方式,去降低了这个用户去学习 AI 的这个焦虑。因为现在很多人就是很多博主都在制造焦虑嘛,他反而是说我这个是一个喂饭的教程,连这个草履虫都能够看懂的这样一个教程。
验证:仿写秋芝风格的口播稿
[05:47] 那我们发现了这些特点之后,就是 AI 就会把它这个所有的说话的方式去整理出来了,刚才的看到的这个 Voice DNA 的这个一个 JSON 里面。那这个东西就是给到智能体去读的,然后我们刚才看到这个网页是给到人去看的。
[06:07] 那这里面的话就会有一个秋芝的这个一句话的风格的画像,然后还有一个如何模仿他的一个角色树,还会有一个刚才我们提到的禁词表。
[06:18] 那我们怎么去验证呢?做完了这一系列之后呢,我就让这个 AI 去在网上做了一个调研,因为最近讨论比较多的一个话题是,一个新入门的小白是该去学 Claude Code 好呢,还是该去学 Codex 好。
[06:34] 那我就以这个话题,让这个 AI 在网上全面的调研了一下,就是大家所有的这些评论或者是这个意见。那把这些调研的结果,用秋芝的风格写成了一篇这个 3300 字的一个口播稿啊。
[06:47] 那最终这个验证的这个效果还是蛮不错的。就我们来看一下,就是这个是我们 AI 做出来的一个仿写的一个过程。你看这个还是比较有特点的哈,哈喽啊朋友们对吧,我是秋芝,今天我们聊一个很多人私信问我的问题,那 Claude Code 和 OpenAI 的 Codex,这两个 AI coding agent,我到底该选哪一个。
[07:07] 那很多人都以为他们是同一个东西,装一个就够了,其实不是对吧,这就非常口语化。然后他又分了就是上手门槛,然后分了几个层级,操作深度对吧,然后再加上定制化,再加上最后的一个价格的比较,那适用场景。
[07:23] 那这五个都完了之后就是按照他的那个风格,他会有一个小结嘛,对吧,今天聊了核心区别怎样怎样。那用了一段时间,如果是问他的预判怎样,然后最后又恭喜大家去获得了一套工具选择判断的框架,资料和链接评论区见。
[07:37] 非常非常的这个,像他的这个风格。我觉得这个文章发给他,他自己也会觉得这是我的逐字稿吧,对吧。
小结:把说话方式变成看得见的文档
[07:44] 那今天我们小结一下,就是我个人觉得这个有意思的地方,就是不在于 AI 能模仿一个博主去表达,而是我们现在真的是有办法,把一个人怎么去说话这件事情,变成了一个看得见的文档。
[07:58] 那这就意味着,就是我把这样的一个思考并且输出的流程,做成一个可以反复用的一个工具。就是换任何一个博主,我只需要在 Claude Code 里面跟他说,就是用这个 skill,比如说这个数字生命卡兹克,那帮我去把它的这个表达方式变成了一个这样的 Voice DNA,这样的一个指纹,去帮我去做这个表达。
[08:25] 那我现在要做的只需要是说,我去关注现在网上的热点话题,加上我的一两个核心的观点 comments,然后再去加上调研的内容,就可以用一个爆款的方式,甚至是说去创立一个我自己独有的一个爆款的方式,去把这个内容去写出来去表达下来。
[08:45] 不知道今天的内容大家有什么启发或者收获呢给我评论,那我们下期再见拜拜。