嗨大家好,我是阿真!
上周分享了一个 Skill,调用 Skill 然后给到文章就可以直出全部配图的,灵感来自于大善人歸藏藏师傅的 guizang-ppt-skill,这个是基于他的 Skill 去进行修改的。
我做好了一套小红书 3:4 比例的,现在差不多可以拿出手了,PPT 的版本还有点小问题,我再优化优化,后期再和大家分享。
这个 Skill 最终的产出是下方这样的,我们可以有自己的 IP 配图作为插图,色调和字体也都可以自己去调整。产出的内容要详细要简单或者要配图也可以自己要求。
这是阿真常用版,是给到我的上一篇文章后,直出的网页预览效果和导出图片效果
图片效果
讲历史的 IP 我也尝试了一版。不过这个表情包我没有仔细盯,做得稍微粗糙了一点。
不想要配图的时候,要求 AI 具体哪些页面使用纯文字版本也可以,可以看有图和无图的对比。
还尝试了一个潮玩版
上面是今天要分享的基于 HTML 转的图片,适合小红书小绿书等图文发布使用,整体比较简洁。
如果不喜欢过度简洁和有秩序的,就喜欢 AI 生成直出图的可以看看这篇→,基于 IP 生成图片的,效果是这样的,更多元化一些,效果如下
喜欢设置好一个模板以后调用就直接套模板出图请继续往下看这篇~!
设置的前期过程稍微繁琐一点,但是后期使用会非常方便。如果你不喜欢看繁琐的图文教程,那么也可以从这里直接看视频教程
我把整个过程打包成了一个 Skill,你可以用它生成一套属于自己的小红书排版模板。以后只需要给它一篇文档,或者给一个飞书云文档链接,如果要直接读取飞书,需要先连接飞书 CLI,它就可以按照已经定好的 IP 和视觉系统,直接帮你生成整套小红书图片。
安装Skill
第一步还是先安装这个 Skill。安装之后,它会提示已经调用“小红书排版工厂”,并让我们选择使用模式:
Compact 模式:如果你已经很熟悉这套操作,可以直接给参考图和 IP 相关的介绍文档,再说清楚自己的需求。
Default 模式:如果还不熟悉,就选择这个模式,让它带着我们完成整套引导。
第一次做,我更建议大家走 Default 默认模式。前面的信息给得越完整,后面的素材、排版和 Skill 就越稳定。
在完整引导中,你可以上传自己的 IP 图片。它会提供一个表格,让你填写 IP 图、Skill 名称、触发词、页脚名字、头像署名和末页账号等信息。
接着,它会询问你有没有多动作素材,也就是有没有基于自己 IP 做过表情包。
如果有,你就直接说明并提供文件路径。
如果没有,就让它帮你生成,它会先基于 IP 写完整提示词,再继续生成图片。
这里可以选择 20 张精简包,也可以选择 45 张详细包。20 张日常已经够用,45 张的表情和动作更丰富,后续做图文排版时,可选择的图片元素也会更多。这里的表情提示词部分,是 Agent 基于 IP 的图片的风格和气质,以及给到的介绍文档来决定的。
简而言之,它会比较符合这个 IP 的气质。比如我要做的这个历史小吏的,生成表情的方向也会更倾向于他的职业属性。如果方向是很宽泛的那种,我们也可以通过指令要求,比如我希望我的 IP 的讲师职业属性体现更明显,也可以在对话中去要求。
它会先交付一套图片和对应的完整提示词。图片细节如果有问题,比如小吏 IP 的卷轴拿反了,可以直接基于原提示词做细微调整,再重新生成单张图片,不需要整套重跑。
图片生成完成以后,一定要自己反复仔细检查图片细节。这里既可以使用系统抠图,也可以自己抠图。Codex 可以直出透明底图片,但是偶尔会出现头图不够干净,中间有马赛克格子的情况。
这时候可以让它自己重做,也可以用抠图工具。我自己抠图可以用 Pixian,大家也可以用你平时习惯的工具去做抠图处理。
有 IP 的四视图时,直接使用给定的四视图。如果手头只有不完整的照片,就可以让 AI 先生成一张完整全身参考图。关于自己的卡通形象的 IP 怎么做,也可以看这篇文章→
接下来 IP 定位卡就有了,没什么问题的话就确认,继续推进生成图片。如果你使用的不是 Codex,可以使用即梦,接入即梦 Cli 或者 Lib TV Cli 或外接 API 等去让它生成系列图片,或者直接让它生成表情提示词,然后你到自己常用的平台去完成表情图的生成,完成后把抠图完成的图片给到 Agent。
有一点很重要,我再提醒一下:一定要等所有人物素材都完成,再推进视觉排版。后面才补素材,很容易出现人物大小差距太大、姿势放不进去、版面留白不合适等问题。
准备IP素材
确认人物图和表情动作包都没有问题以后,我们在对话里输入“确认素材”。
这时它才会开始反推排版视觉系统,也就是接下来要生成的小红书常用排版模板。它会先给出 A、B、C 三组视觉建议,让我们选择配色、字体和整体气质。
接下来可以选择逐项确认,也可以直接采用一整套推荐方案。逐项确认时,底色、气质、主色、点缀色、字体、装饰语言和主题命名等内容都会分开选择。你可以按照 A、B、C 自由组合,也可以整套采用其中一组。不知道选什么的时候,优先试试它推荐的那一组。
如果选择推荐方案,比如选 B,几个维度就会统一按照 B 方案执行。如果选择逐项确认,它会把这些项目一个个列出来。它给出的字体都不喜欢时,可以直接指定字体,或者提供字体文件。配色和装饰也一样,都可以继续给自己的意见。
视觉决策确定以后,它就会进入头像基准校准。这个头像一般放在图片的正文页面右上角,既能强化账号识别,也能补足右上角的留白。
头像完成后,要检查人物有没有被裁切、大小是否合适、和正文区域会不会互相挤压。确认没问题,再进入下一步。前一步完成了它有指引的话就跟着指引继续做,如果没有指引你就自己对它说继续,它会继续推进的。
保存自己的Skill
这一步需要提供一篇文章或者参考文档,让它跑出第一版 Demo。我当时随便给了一篇历史人物故事,它会先读取素材,再根据文章内容生成整套页面。
第一版出来后,可能会很不错,也可能有一些地方不满意。这个阶段就继续微调。比如我觉得一开始的卷轴不好看,就让它去掉卷轴造型,同时保留卷轴的配色,再把留白收紧一点。
还可以让它多做几种版面,把后面可能会用到的图文、流程、对比、清单和重点句式都尽量覆盖到。这样保存下来的 Skill 才更适合长期复用。
当页面效果基本确定,就可以让它保存排版 Skill。这里保存的,就是刚刚我们一起完成的、基于自己 IP 和视觉偏好的专属排版 Skill。
最后一般会在回答中呈现三部分:
Skill 完整目录。
Skill 的 markdown 文档(放在 1 的目录里了)。
一套已经设置好的多页案例的网页。
交付完成后,直接安装这个 Skill,再给它新的文章或资料,就可以继续制作前面那样的套图。
潮玩方向案例
接下来换一个潮玩方向的案例,我们快速过一遍。
假如我要做一套潮玩模板,我也可以直接把自己的 IP 形象、品牌案例和相关文档全部提供给它。它会按照 Default 模式提取资料里的信息,直接完成这一步。
接着指定生成数量,比如让它做 20 张表情动作包。它会先基于定位卡规划 8 张通用动作、8 张潮玩场景动作和 4 张情绪补位图,再锁定视觉锚点和关键元素,最后开始建立素材包并生成图片。
这一步完成后,一定要仔细检查每一张图。动作、手指、道具方向、衣服细节、五官和角色一致性,只要有一项不够好,就直接在对话里要求它重做。
如果交付的是已抠图版,也要确认它有没有真的完成抠图,头发边缘、半透明区域和白边处理得怎么样。效果还不够好,就用抠图工具重新处理,再把成品放回素材库替换原图。
确认素材整理好以后,再让它继续下一步。它会给出一套视觉 tokens,包括主题、配色、字体和装饰语言。草稿文件里会记录更细的规则,暂时看不懂也没关系,第一版效果出来后,我们会更容易判断自己具体想改哪里。
有时第一版页面会出现显示不完整的情况,不要慌,直接让它检查页面原因并自动修复就可以。
Demo 出来以后,也可以继续调整背景色、右上角头像大小、文字颜色、页面留白和版式数量。
如果图片压到文字、卡片底部余量太小、流程线穿过内容等问题还存在,可以在网页里点选对应位置,通过评论让它修改,也可以直接在对话里说明问题。
修改完成后刷新预览,再看新版页面。质检记录会保存这次具体改了什么。所有细节完成后,再做一次整套预览,确认没有问题再导出图片。
确认没问题了,就保存这个 Skill。
下次要调用,就这样操作。
还有更多进阶玩法,比如说,除了这些以外,大家还可以通过补充图表、修改排版、修改字体去继续调整版面效果。
我之前做带 IP 的小红书图片,更多会直接让模型生成整张成品。这个方式的优势很明显,起步快,画面自由度高,人物、场景、光影和装饰可以一起生成,特别适合做氛围强、插画感强、每一页画面差异都很大的内容。
它的限制也比较明显。效果不见得稳定,可能还需要抽卡,版式一致性会波动,人物和文字的位置很难精确控制。想把标题往上挪一点,或者只改一个字,就需要重新生成,而这类图片经过修改后经常会折损细节。页面数量多以后,保持字体、字号、边距和视觉节奏统一也会更费时间。
HTML 方式会把人物素材、字体、颜色、卡片、边距和版式规则先固定下来,再根据文章内容生成不同页面。文字由代码渲染,错字和乱码会少很多;标题、正文和人物位置也更稳定,局部修改通常只需要改对应的文字或样式。
它很适合批量内容和长期复用。同一套模板可以反复读取新文章,自动拆页、渲染、导出,再生成一张联系表做总览检查。做完一次,后面每次调用都会省很多时间。
当然,它的前期准备会更多。人物素材需要提前整理好,字体要能正常加载,视觉 tokens 和页面组件也要先定下来。遇到特别自由的插画场景,HTML 的画面表现力会受到模板结构限制,页面也可能一直带一点排版系统的规整感。
如果这一组内容更看重氛围、故事和单张画面的视觉冲击,我建议优先考虑直接生图。如果内容更看重中文准确、系列统一、可反复修改和长期批量输出,可以考虑用 HTML 模板。
也可以把两种方式结合起来,封面继续用图片模型生成,正文、卡片交给 HTML。这样既保留了封面的表现力和视觉冲击力,也能提高文字和版式的稳定性。
如何多次复用
以后复用这套 Skill 很简单,直接说调用它就可以。只要能调用 Skill 的工具都可以用。也可以给飞书云文档链接,前提是已经连接飞书 CLI。
调用飞书 Cli 的一大好处就是如果你文章中有配图,只要和它说要把图片加进去,那么它也可以直接提取和搭配。
它会先根据文章确定这一组图片的内容结构,再并行渲染页面、加载字体,最后生成一张总览联系表进行检查。检查内容通常包括标题区、卡片底部余量、人物与页角、流程线通道等细节。
完全收尾以后,它还会做尺寸和视觉的双重验收。发现问题就继续做局部修正,最后交付整套网页预览、导出图片和联系表总览。图片默认可以导出 2K,发小红书等社交平台已经够用了。
终端党也可以。调用后给文章链接或路径就行
排版完成以后,发现某一页还有小问题,也可以直接点网页,通过评论修改,也可以看到效果后指出那些页面需要修改。调整结束后让它重新导出就可以。
小结
Skill 链接在这里,安装就是直接复制链接让 Agent 安装就好了。
链接
none
https://github.com/irenerachel/xiaohongshu-layout-factory-skill总的来说,这个 Skill 是一个用来帮你做基于你的 IP 的小红书排版图 Skill 的 Skill,你用这个 Skill 做的 Skill,后续就可以反复复用那个 Skill 来做自己的图片了。哎嘿有点绕了。
再梳理一遍制作流程。
安装小红书排版工厂,第一次选择 Default 模式。
提供 IP、IP 或品牌信息和内容方向。
直接给、生成 20 张或 45 张表情动作包,逐张检查并完成抠图。
输入“确认素材”,再确定配色、字体和装饰语言。
校准右上角头像,用一篇完整文章跑第一个 Demo。
修改版式、留白、颜色、人物位置和页面细节。
保存专属排版 Skill,并完成安装。
以后在新对话里调用第 7 步保存的那个 Skill,提供文档,检查总览的 html 网页效果,没问题再导出 2K 图片。
整套流程里,最需要花时间的其实是前面的素材准备和第一版模板校准。这里做得越认真,后面复用就越轻松哦。
再次感谢藏师傅开源了 guizang-ppt-skill,我的这个 Skill 在其版式和工程化方面从中获益良多,很有收获!
好了,今天的分享就到这里,如果大家也需要做自己的 IP 排版 Skill,可以尝试一下,做好之后需要修改的细节真的不多。对于经常需要发送图文的朋友们来说应该会有帮助。
如果内容大家觉得内容有趣、有用,欢迎在下方 和 鼓励,期待你的猛猛三连,这对阿真真的很重要,非常感谢~
下期见~
热门跟贴