大家好!我是瓜哥。前互联网技术副总裁,现在带队死磕 AI 编程。
今天社群里,小伙伴分享了一个 github 上的生图 skill。
我一看,立马来了兴趣。完美适配公众号技术文章配图嘛,用怪诞风格的个人形象去科普那些复杂的 AI 技术原理。
这个 skill 出的图,全都长在了我的审美点上:极简、手绘风格。
01 / 原作版本
① “一鱼多吃” 示意图

② “信息井” 示意图

02 / 瓜哥定制版
① “输入决定输出” 示意图

② "skill 原理" 示意图

一开始,我只是想装上试试,结果发现还能自定义个人 IP,这下就有意思了。
这篇文章,我就把整个过程拆开讲清楚。
先丢给你一张自定义 IP 省流版:
03 / 需修改的文件地图
这张表就是整个改造的核心。
| 目标 | 要改的文件 | 重点 |
|---|---|---|
| 改 Skill 名 | SKILL.md | name 和触发描述 |
| 改角色 IP | references/guage-ip.md | 外形、比例、禁忌 |
| 改生图提示词 | references/prompt-template.md | 角色英文描述和画面约束 |
| 降低复杂度 | references/style-dna.md | 留白、物件数量、箭头数量 |
| 控制构图 | references/composition-patterns.md | 一图一动作 |
| 做质量检查 | references/qa-checklist.md | 失败信号和重生成规则 |
如果看完你还搞不定,点关注,私信我,免费教你!
进入实操,干货加码...
04 / 我为什么要改一个生图 Skill
① 原始 Skill 已经很强
我最开始参考的是 Ian 开源的这个仓库:
https://github.com/helloianneo/ian-xiaohei-illustrations
它的核心能力很明确:把中文文章里的判断、流程、状态和隐喻,变成白底、手绘、怪诞但清爽的正文配图。
这个方向很适合公众号,因为公众号配图最怕两件事。
第一,太像 PPT。
第二,太像图库插画。
这套 Skill 的好处是,它不是在做 “漂亮插图”,而是在做 “文章里的核心提取”。
② 我想要自己的 IP
原始版本里有一个固定角色叫“小黑”。
但我希望我的文章配图里,能出现一个自己的固定角色。
我给这个角色起名叫“瓜哥”。

它不是个静态头像,而是一个基于文章核心含义的表达者。
把复杂系统讲成人话,比如:
- 拆流程
- 筛素材
- 压废话
- 补断点
说白了,我想要的不是一张随机插图,而是一套能持续出现在我文章里的视觉语言。
第 1 步:先 Fork,不要直接魔改
① 为什么要 Fork
我建议先 Fork 原仓库,再 Clone 自己的版本。
原因很简单。如果你直接 Clone 原仓库然后本地改,后面会变成一个不可追踪的私有版本。
但 Fork 之后,你至少还能保留来源,也方便以后对比上游更新。
我的仓库是这个:
https://github.com/zhaodl1983/guage-ip-illustrations
本地路径类似这样:
git clone git@github.com:zhaodl1983/guage-ip-illustrations.git② 改目录名和 Skill 名
我把原始 Skill 目录名和SKILL.md 里的 name,从 “ian-xiaohei-illustrations” 改为了 “guage-ip-illustrations”。
这个名字很关键。
后面在 Codex 里调用 Skill,就直接这样 /guage-ip-illustrations为 “skill 目录” 生成 1 张正文配图。

第 2 步:不要一上来重写全部
① 真正该保留的是风格系统
这个 Skill 最有价值的部分,不是某个角色,而是它的风格系统。
我保留了这些东西:
- 纯白背景
- 黑色手绘线稿
- 少量红橙蓝中文批注
- 大量留白
- 低科技隐喻
- 非 PPT 感
- 一张图只讲一个核心结构
这些规则决定了图像的质感。
如果一上来全部重写,很容易把原来的精髓弄丢。
② 真正该替换的是角色系统
我重点改的是这些文件:
references/guage-ip.mdreferences/prompt-template.mdreferences/qa-checklist.mdreferences/composition-patterns.mdSKILL.md其中最重要的是:
references/guage-ip.md这里定义了瓜哥的外形、动作、气质和禁忌。
一开始,我把瓜哥写成“圆脸、短发、黑色 Polo、严肃表情”。
结果很快翻车。
AI 直接画成了一个油腻中年大叔。

第 3 步:角色 IP 要写得非常具体
① 抽象描述不够用
我发现一个问题。
如果你只写:
年轻化、轻卡通、黑色短发模型会自由发挥。
一会儿画普通男青年,一会儿画写实中年人,一会儿画成商务头像。
所以后面我把规则改得很硬。
现在瓜哥的设定是:
怪诞动画小人大头小身体小胳膊小腿黑色小背心黑色短裤一点怪诞小圆肚黑色实心短刺猬头冷静短线眼同时明确禁止:
不要 Polo 衫不要裙子不要长袍不要短斗篷不要写实中年脸不要油腻肚腩不要普通顺滑短发这一步非常重要。
你不能只告诉 AI “我要什么”,还要告诉它“什么绝对不要”。
② 头发这种细节也要锁死
我测试时发现,第一张图的人物最稳定。
它的头发是短、密、黑色实心的小刺猬头。
后面有些图发型变成了“蒲公英”,看起来就不稳定。
所以我最后把头发写成:
黑色实心短刺猬头头顶和两侧是一圈很短、密集、黑色实心小三角毛刺不要长针刺不要稀疏蒲公英不要灰白线稿头发不要普通顺滑短发这就是做 IP 的关键。
不是追求一次好看,而是追求多次稳定。

第 4 步:长文配图一定要先压缩
① 画面变乱的根源
一开始我们生成长文配图时,画面很容易变复杂。
满屏机械、线缆、箭头、英文乱字。
后来我发现,根源不是生图模型突然变差。
而是 Skill 没有先把长文压成一句话。
你给它一大段内容,它就想把所有信息都画进去。
这就完蛋了。
文章有 4 个观点,它画 4 个模块。
文章有 6 个功能,它画 6 条线。
最后就变成密密麻麻的“伪信息图”。
② 我加了一个硬规则
现在 Skill 里有一条强规则:如果输入是一段长文、多个段落或信息很密的材料,必须先把每张图的内容压缩成一句话:
这张图只表达:<一句话核心含义>这句话必须只包含一个判断或一个动作。
比如这段内容:
| 原本内容 | 可以压成 |
|---|---|
| Skill 是轻量能力包,依赖渐进披露,只先加载 name 和 description,命中后再加载 SKILL.md 和 references。 | 这张图只表达:Skill 先露出名牌,命中后才展开核心和引用资料。 |
这样画面就会简单很多。

第 5 步:把输出路径和尺寸写死
① 输出目录要固定
我希望所有生成图都进入固定项目目录,所以我在 Skill 里写了保存规则:
/Users/Documents/workspace/guage-ip-illustrations/assets/<article-slug>-illustrations/这样后面写文章、整理素材、回看版本都更方便。
② 尺寸也要明确
我希望正文图是宽画幅,目标尺寸:1800 x 766
这里有个细节。
1800x766 不是严格 16:9,它更宽。
所以我在 Skill 里写清楚:
默认目标尺寸 1800x766。如果工具不能精确指定,就保持横版宽画幅。不要输出方图。这能减少很多随机尺寸问题。
05 / 我现在怎么调用这个 Skill
① 最小测试 Prompt
如果只想测试人物形象,我会这样写:
Use $guage-ip-illustrations 为“输入质量决定输出质量”生成 1 张正文配图。要求:1. 先输出一句话核心含义。2. 瓜哥必须是怪诞动画小人:大头、小身体、小胳膊、小腿。3. 服装是黑色小背心 + 黑色短裤,短裤下面能看到两条小腿。4. 头发是黑色实心短刺猬头,不要蒲公英头。5. 可以有一点怪诞小圆肚,但不要油腻肚腩。6. 不要裙子、长袍、短斗篷、Polo 衫。7. 画面极简,目标尺寸 1800x766。这条用来测 IP。
不要一上来就塞长文,先把角色稳定住。
② 长文配图 Prompt
如果是给文章配图,我会这样写:
Use $guage-ip-illustrations 根据下面这段内容生成 1 张正文配图。要求:1. 先把内容压缩成一句话核心含义,并输出“这张图只表达:xxx”。2. 图片只画这一句话,不要把多个信息点塞进去。3. 瓜哥保持固定 IP:大头、小身体、小胳膊、小腿、黑色实心短刺猬头、黑色小背心、黑色短裤。4. 画面只保留一个主物件,最多 5 个中文短标注。5. 目标尺寸 1800x766,输出到固定 workspace。<粘贴长文>这条用来测理解能力。
看它有没有真的把内容压成一句话。
06 / 你可以怎么开始
① 方案一:从原始仓库 Fork
如果你想从头做自己的 IP,我建议直接 Fork 原作者的仓库:
https://github.com/helloianneo/ian-xiaohei-illustrations
然后按这个顺序改:
1. 改 Skill 名2. 改角色 IP 文件3. 改 prompt-template4. 改 qa-checklist5. 用 3 张图测试稳定性6. 根据失败图继续补禁忌这个方案最适合想深度定制的人。
② 方案二:直接用瓜哥版本
如果你觉得瓜哥这个版本已经够用,也可以直接用我的 Fork:
https://github.com/zhaodl1983/guage-ip-illustrations
安装方式:
git clone git@github.com:zhaodl1983/guage-ip-illustrations.gitmkdir -p ~/.codex/skillscp -R ./guage-ip-illustrations/guage-ip-illustrations ~/.codex/skills/然后在 Codex 里调用:
Use $guage-ip-illustrations 为“输入质量决定输出质量”生成 1 张正文配图。如果你用其他 Agent,也可以把它放到对应的 skills 目录里。
07 / 写在最后
这次改造给我的最大感受是:生图 Skill 的核心,不是提示词写得多漂亮,而是把“风格、角色、动作、禁忌、检查项”拆成一套可迭代系统。
一次生成好看,不算难。
难的是 10 次生成都像同一个世界观。
这也是 Skill 真正好用的地方。
它不是一段临时 Prompt,而是一个可以不断修正、不断沉淀的本地能力包。
最后也感谢 Ian 开源原始的 ian-xiaohei-illustrations,这套 “小黑怪诞正文配图” 的思路给了我很好的起点。
以上,就是今天的全部内容。
提交反馈
图文分享一个免费生图 Skill,终于让 AI 配图有了统一画风,还能定制个人IP。
评论区
暂无公开评论还没有公开评论。