蒸馏=AI时代的合法抢劫?!如何将一本书蒸馏成Skill?
这篇文章,我的喂饭教程,手把手带大家蒸馏一本书,并教大家怎么把蒸馏好的skills用起来。教程采用的agent是腾讯家的Workbuddy。
第一步,先准备要蒸馏的资料
可以是一本书,也可以是一类资料。
把要蒸馏的书,找个专门的文件夹放进去。
准备蒸馏《王川宝典》:前几天去找一位大佬聊天,就聊到了书,然后我让他给我推荐一本书,他说他平时没什么事,读了很多书,一般的书都没有什么新意了,最有启发的还是巴菲特、芒格、段永平,以及这本《王川宝典》(我也准备读一读)。

《王川宝典》我下载下来的时候是PDF,通过一些工具转成了markdown,也可以转成txt的格式(在Google搜PDF免费转MD)。
如果带图,并且图片里面也有重要内容的话,最好用OCR识别,把图片内容准确识别下来。
也可以直接丢给豆包的最新模型,Seed-Evolving试试,它的视觉识别能力超强。
或者使用Doc2X,这个工具虽然是收费的,但是不算贵,识别转换的效果也挺好的。
第二步:安装workbuddy
workbuddy可以在workbuddy.ai下载(傻瓜式安装)安装过的这里可以跳过。
打开之后直接可以微信扫码登录
第三步:在workbuddy找到仓颉skill
在技能->搜索仓颉skill->推荐->仓颉skill

接着进入到仓颉skill,点击「去试试」

指令很简单,让仓颉Skill直接蒸馏就行了,书的文件,直接复制粘贴到workbuddy的对话框

workbuddy的模型选择也挺多的(Hy3还是免费)

workbuddy好的一点就是还可以自定义api,coding plan等等

甚至可以接入一些中转站的,这也是我觉得workbuddy最棒的点之一,开放、灵活。

但是我不得不提醒大家,蒸馏书这件事,本身就是比较耗token的。
模型这块,如果是省钱,可以先直接用Hy3,目前在workbuddy上面可以免费使用。

不过,最近我测试下来,感觉蒸馏书性价比最高的可能还是DeepSeek-V4-Flash 正式版。效果,速度,价格都兼顾了。
并且workbuddy内置的已经是DeepSeek V4 Flash正式版了,最大的差异就是,你如果自定义接入DeepSeek官方的API是无法识别图片的,使用workbuddy内置的模型就可以。
*注意:大家一定一次只蒸馏一本书,或者一类资料。
如果是第一次蒸馏,可以用免费模型(Hy3)先试试水(当然,模型越好,蒸馏的效果是会更好的)
ok,万事俱备!
第四步:直接开蒸(这次模型选用的workbuddy内置的DeepSeek V4 Flash)
整个蒸馏过程差不多花了30分钟,蒸馏出12个skill。

顺便说一句:可以看到DeepSeek V4 Flash蒸馏一本书只花了65积分,而workbuddy每天都能免费领取100积分😄,基本上算免费了。如果想完全免费,就用Hy3来蒸馏吧。
那,蒸馏出来Skill到底怎么用呢?
有些朋友也担心,蒸馏的skill越来越多,会非常乱。
我目前的做法是按项目来蒸馏、使用。

接下来,给大家演示,蒸馏好的王川宝典Skill的效果到底怎么样?
叠个甲,以下只是演示效果,我问了我想问的一些问题,AI给出的答案不构成任何投资建议!!
首先第一个AI的回答(不构成任何投资建议)。
回答效果如下:

我觉得,他给的第二个招聘建议非常好。
跟我所想的大差不差,但是能更坚定我的想法。同时也给了一些建设性的意见。
下面是我用Kimi K3,不用任何工具,仅靠模型自身的回答(跟上面问是同样的问题):

不知道你能不能看出一些什么区别
使用蒸馏后的skill,和完全依靠模型能力的回答,这两个的区别我觉得就是:
模型虽然也能给出一些不错的建议。但是他给不了太多的确定性,你会觉得他的答案有一些道理,但是好像又差点什么,缺一点什么。
蒸馏书之后的 skill 用起来,我觉得它能给一些关键的、建设性的建议,能给我更多的确定性。
像这种一些通用的问题,其实效果都已经算明显了。所以如果去蒸馏那些 AI 还没有训练过的信息,比如说网上最新的一些资料,以及一些私有的高价值信息。差异应该会更加的明显。
我这里用的是 Kimi K3,是一个比较强的模型。我觉得蒸馏书的差异,在你使用一些相对差的模型时,比如本地小模型,效果差异会更明显。





