蒸馏=AI时代的合法抢劫?!如何将一本书蒸馏成Skill?
这篇文章,我将手把手带大家蒸馏书,并教大家怎么把蒸馏好的skills用起来。
我是最近猛猛蒸馏的袋鼠帝
感谢大家的厚爱,仓颉Skill已经6.7K Star啦!(欢迎大家多多Star)
https://github.com/kangarooking/cangjie-skill
上周发了一条仓颉Skill入驻腾讯WorkBuddy的文章。
评论区问得最多的问题是怎么蒸馏?蒸馏之后怎么用?有啥用?
首先,我觉得大家最关心的问题肯定是蒸馏出来有啥用?有哪些场景?
其实一开始我也纳闷,我也没想出多少场景来
后面我在仓颉Skill交流群里面向大家收集了一波反馈:
没想到大家的使用场景这么多,还得是你们。
我挑几个经典的使用场景给大家分享一下(已征求使用者同意)
比如有位老哥,就用仓颉Skill蒸馏小红书官方给商家的投流指导。
蒸馏、优化出来10个Skill
还有在AI4science上的使用场景,居然能得到博士的认可,我是没有想到的。
然后还有用仓颉Skill,蒸馏Skill去卖的
一个29.9...
还有用来蒸馏课程的,蒸馏剧本的,金融分析的,蒸馏企业规章制度的,蒸馏科学访谈的...使用场景太多了。
然后,据说那篇文章,好多ai社群都在传,看来大家需求确实旺盛
所以,只要你有行业信息,使用场景其实还挺多的。很多都是企业的场景。
不过,对于个人来说,最直接的使用方式可能还是蒸馏书。
接下来,我将手把手带大家蒸馏一本书,并教大家怎么把蒸馏好的skills用起来。
这篇抛砖引玉,你们可以用这个方法去蒸馏任何资料~
顺便在提一嘴,仓颉skill已经有官网啦
cangjie-skill.com
ok,话不多说,开始蒸馏!
整个流程就4步
第一步,先准备要蒸馏的资料
可以是一本书,也可以是一类资料。
把要蒸馏的书,找个专门的文件夹放进去。
这次我准备蒸馏《王川宝典》:
前几天去找一位大佬聊天,就聊到了书,然后我让他给我推荐一本书,他说他平时没什么事,读了很多书,一般的书都没有什么新意了,最有启发的还是巴菲特、芒格、段永平,以及这本《王川宝典》(我也准备读一读)。
《王川宝典》我下载下来的时候是PDF,通过一些工具转成了markdown,也可以转成txt的格式(在Google搜PDF免费转MD)。
如果带图,并且图片里面也有重要内容的话,最好用OCR识别,把图片内容准确识别下来。
也可以直接丢给豆包的最新模型,Seed-Evolving试试,它的视觉识别能力超强。
或者使用Doc2X,这个工具虽然是收费的,但是不算贵,识别转换的效果也挺好的。
第二步:安装workbuddy
workbuddy可以在workbuddy.ai下载(傻瓜式安装)
打开之后直接可以微信扫码登录
第三步:在workbuddy找到仓颉skill
在技能->搜索仓颉skill->推荐->仓颉skill
接着进入到仓颉skill,点击「去试试」
指令很简单,让仓颉Skill直接蒸馏就行了,书的文件,直接复制粘贴到workbuddy的对话框
workbuddy的模型选择也挺多的(Hy3还是免费)
workbuddy好的一点就是还可以自定义api,coding plan等等
甚至可以接入一些中转站的,这也是我觉得workbuddy最棒的点之一,开放、灵活。
但是我不得不提醒大家,蒸馏书这件事,本身就是比较耗token的。
模型这块,如果是省钱,可以先直接用Hy3,目前在workbuddy上面可以免费使用。
不过,最近我测试下来,感觉蒸馏书性价比最高的可能还是DeepSeek-V4-Flash 正式版。效果,速度,价格都兼顾了。
并且workbuddy内置的已经是DeepSeek V4 Flash正式版了,最大的差异就是,你如果自定义接入DeepSeek官方的API是无法识别图片的,使用workbuddy内置的模型就可以。
注意:大家一定一次只蒸馏一本书,或者一类资料。
如果是第一次蒸馏,可以用免费模型(Hy3)先试试水(当然,模型越好,蒸馏的效果是会更好的)
ok,万事俱备!
第四步:直接开蒸(这次模型选用的workbuddy内置的DeepSeek V4 Flash)
完整过程请看VCR:
整个蒸馏过程差不多花了30分钟,蒸馏出12个skill。
可以看到DeepSeek V4 Flash蒸馏一本书只花了65积分,而workbuddy每天都能免费领取100积分,基本上算免费了。如果想完全免费,就用Hy3来蒸馏吧。
上次我尝试用Kimi K3来蒸馏,跑了三分之二,直接耗了2000积分...
那,蒸馏出来Skill到底怎么用呢?
有些朋友也担心,蒸馏的skill越来越多,会非常乱。
我目前的做法是按项目来蒸馏、使用。
也就是我会开一个新的文件夹(像刚刚视频里面那样),作为一本书的(或者任何资料)的工作空间。蒸馏好的skill也会要求放在这个空间里面,使用的时候也是以这个文件夹作为工作空间。
接下来,给大家演示,蒸馏好的王川宝典Skill的效果到底怎么样?
叠个甲,以下只是演示效果,我问了我想问的一些问题,AI给出的答案不构成任何投资建议!!
首先第一个AI的回答(不构成任何投资建议)。
回答效果如下:
可以上下滚动的图片
我觉得,他给的第二个招聘建议非常好。
跟我所想的大差不差,但是能更坚定我的想法。同时也给了一些建设性的意见。
然后下面是Kimi K3,不用任何工具,仅靠模型自身的回答(跟上面问是同样的问题):
不知道你能不能看出一些什么区别
使用蒸馏后的skill,和完全依靠模型能力的回答,这两个的区别我觉得就是:
模型虽然也能给出一些不错的建议。但是他给不了太多的确定性,你会觉得他的答案有一些道理,但是好像又差点什么,缺一点什么。
蒸馏书之后的 skill 用起来,我觉得它能给一些关键的、建设性的建议,能给我更多的确定性。
像这种一些通用的问题,其实效果都已经算明显了。所以如果去蒸馏那些 AI 还没有训练过的信息,比如说网上最新的一些资料,以及一些私有的高价值信息。差异应该会更加的明显。
我这里用的是 Kimi K3,是一个比较强的模型。我觉得蒸馏书的差异,在你使用一些相对差的模型时,比如本地小模型,效果差异会更明显。
这也是很适合一些有私有化部署小模型需求的企业场景。
最近也有很多朋友问,怎么蒸馏视频,我用字节的Seed-Evolving模型试了一下,搭配Seed-Evolving超绝的视觉能力,可以把视频信息提取的更完整,视频蒸馏的效果也会更好。
感兴趣的朋友可以三连告诉我,并点个关注,我将尽快分享出来~
最后,这篇文章我希望在评论区收集一波大家的反馈:
好的反馈、不好的反馈、待优化的点。大家都可以在评论区打出来,这样我才知道你们更深一步的需求是什么,我也才能更好地去优化仓颉 skill。
还有什么疑问,也可以在评论区打出来。
我是袋鼠帝,一个致力于帮你把AI变成真实生产力的博主。我们下期见。
能看到这里的都是凤毛麟角的存在!
如果觉得不错,随手点个赞、在看、转发三连吧~
如果想第一时间收到推送,也可以给我个星标⭐
谢谢你耐心看完我的文章~
热门跟贴