personal-ip-generator 使用指南¶
目标:搞清楚
Gayaya999/personal-ip-generator这个 skill 在干什么、它能产出什么、怎么用最低成本拿到一组能直接用的个人 IP 头像 + 表情包。 更新日期:2026-08-01
1. 一句话结论¶
- 它是遵循 skill 协议的 Agent skill(GitHub README 写的是 Codex,实际 MiniMax 等平台同样可以运行),通过 7 步向导产出个人 IP 头像 + 中文九宫格表情包,可选 9 张透明贴纸
- 需要 Agent 自带图像生成能力 — 6 张预览 + 1 张头像 + 9 张表情 + (可选)9 张透明贴纸,每张都消耗 token/积分,跑完一轮大概 25–30 张图
- 不联网(除调图像模型外)、不需要单独的 API key — 走 Agent 内置的图像生成通道,Token Plan 余额/积分直接扣
- 只提取抽象视觉特征(脸型比例、发型、气质),不复制参考图的人脸/文字/商标/构图
- 不直接进 Zensical 站(产物是图像资产,不是 HTML/JS),但成品 PNG 可以作为站点素材被引用
2. 它能产什么¶
两种 IP 模式:
| 模式 | 输入 | 输出 | 适合 |
|---|---|---|---|
| 人物 IP | 上传 1 张本人照片 | 抽象特征驱动的卡通头像 + 表情包 | 个人品牌头像(公众号/Twitter/GitHub) |
| 代表形象 IP | 纯文字描述(性别/气质/风格) | 全新创作的角色形象 | 团队/品牌 mascot、虚拟身份 |
5 种预设画风:
| ID | 名称 | 主要特征 |
|---|---|---|
caihui-feng |
彩绘风 | 温暖纸张感、圆润角色、柔和表情 |
xian-tiao-feng |
线条风 | 黑白线稿、极简五官、留白构图 |
3d-feng |
3D 风 | 潮流 3D、柔和材质、立体光影 |
illustration-feng |
插画风 | 平面色块、人物插画、利落轮廓 |
figure-feng |
手办风 | 收藏手办质感、立体造型、产品级陈列 |
完整风格约束见仓库
references/style-presets.md,每种画风都有缩略图和提示词基线。
标准交付物:
- 一张 4×3 成品板 PNG/JPG:左侧正式头像(1 个),右侧九宫格表情包(9 个,带中文标注)
- (可选)9 张透明背景 PNG 贴纸,可以直接发微信群、Discord、Slack 当表情包用
3. 适用与不适用¶
| 场景 | 合不合适 | 备注 |
|---|---|---|
| 个人品牌头像(公众号 / Twitter / GitHub) | ✅ 最适合 | 一次产出,风格统一 |
| 表情包/贴纸包(微信群 / Discord / Slack) | ✅ 主功能 | 中文标注,可直接发 |
| 团队/品牌 mascot | ✅ 代表形象 IP 模式 | 不基于真人,纯文字描述 |
| 个人主页 favicon / logo | ⚠️ 可以但不强求 | 4×3 成品板偏大,需要二次裁剪 |
| 商业品牌 VI / 正式 logo | ❌ | 它的强项是 IP 不是 logo |
| 写实人像 / 油画肖像 | ❌ | 偏卡通,不适合写实 |
| 多人合照 / 家庭 IP 集合 | ❌ | 单人 IP 模型 |
4. 安装(一次搞定)¶
4.1 Codex 路径¶
git clone https://github.com/Gayaya999/personal-ip-generator.git \
~/.codex/skills/personal-ip-generator
装完在 Codex CLI / IDE 插件里用 $personal-ip-generator 调起,或者直接说"帮我做个个人 IP 头像"。
4.2 MiniMax / 其它支持 skill 协议的 Agent 路径¶
MiniMax 这类 agent 通常预装或一键安装该 skill,直接对 agent 说"帮我做一个个人 IP 头像 / 表情包"即可(skill description 里有触发关键词)。
本机验证:
路径下有 SKILL.md + references/ + assets/style-presets/ 这套结构,说明已就绪。
4.3 Token 消耗(必看)¶
- 跑一次完整 7 步流程大约消耗 25–30 张图:6 张预览 + 1 张头像 + 9 张表情 + 1 张 4×3 合成板 + (可选)9 张透明贴纸
- 走 MiniMax Token Plan / Codex 内置计费,会扣账户余额或积分
- 中途换风格/换特征,预览会重来,token 也会重扣
- 预算参考:跑通一次大约相当于 2–3 轮普通对话的图像消耗
5. 工作流(7 步)¶
IP 类型(人物 / 代表形象)
→ 风格(5 选 1,或传一张临时自定义参考图)
→ 强化特征(脸型 / 发型 / 关键五官 / 气质)
→ 配色(主色 + 辅色,1–3 个)
→ 提示词确认(回读给你看,改到满意再继续)
→ 一张 3×2、带 1–6 编号的六款预览
→ 你选编号 → 正式头像 + 九宫格表情包成品板
→ (可选)导出 9 张透明底表情贴纸
几个关键设计点:
- 每步都能回退 — 风格不喜欢可以重选,特征描述不满意可以改,确认前都有"再调一下"的机会
- 3×2 预览 = 6 个方向 — 一次给你 6 种变体,避免单次抽卡赌脸
- 编号 + 中文批注由宿主叠加,不依赖图像模型生成文字 — 大幅降低乱码、错位、错字
- 不复制参考图 — 只抽抽象特征(脸型比例、发型风格、气质),人脸/文字/商标/构图都不复用,既规避版权风险,也避免"像不像本人"的两难
6. 典型用法¶
skill 支持三类典型输入,根据手头素材自由组合:
模式 A:基于本人照片做个人 IP¶
- 素材:本人正面半身照 1–3 张(干净背景、表情自然最好)
- 走法:人物 IP → 选预设画风 → 描述关键特征(发型/眼镜/服装/气质)→ 配色 → 确认 → 六款预览 → 选号 → 成品
- 拿到:4×3 成品板(1 个头像 + 9 宫格表情)+ 9 张透明贴纸 PNG
- 用途:个人公众号 / Twitter / GitHub 头像 + 群聊表情包
模式 B:做品牌 / 团队 mascot(无真人照)¶
- 素材:无,纯文字描述
- 描述维度建议:性别 / 年龄段 / 发型 / 服装 / 主色调 / 气质关键词(例如"温和、专业、年轻")
- 走法:代表形象 IP → 选预设画风 → 文字描述 → ...(同 A 后续)
- 拿到:同 A
- 用途:产品/团队/小品牌 mascot、虚拟客服形象
模式 C:有特定风格参考图¶
- 素材:本人照片 + 1 张你喜欢的风格参考图(任意画风的角色图)
- 走法:人物 IP 或代表形象 IP → 选「自定义风格」上传参考图 → 后续同 A
- 拿到:同 A,但整体风格向参考图靠拢
- 适用:五种预设画风都不满意,想贴近某个具体画师 / IP 的视觉调性
体感提示¶
- 六款预览选号是分水岭 — 同一份特征描述下,6 张图气质差异可能很大,选错风格/特征组合会导致后面整套重做
- 风格和特征阶段多花 5 分钟,比之后返工省一小时(也省 token)
- 每张图都会扣 token/积分,预览阶段多看少选反而更经济
7. 限制与坑¶
- 需要图像生成能力 + token/积分 — 跑一次完整流程扣一次(参考 §4.3)。不打算花钱就别开这个 skill
- 没有 Web UI — 所有交互都走 Agent 对话框,没有图形化向导
- 多平台支持,但触发方式因平台而异 — Codex 用
$personal-ip-generator或自然语言,MiniMax 这类直接用自然语言描述意图(skill description 触发) - 风格只能 5 选 1 或传临时参考图 — 不支持"基于 XX 风格微调参数",要么用预设要么用一张完整的风格参考
- 表情包文字是中文且固定 9 个 — 标注写死:
开心 / 大笑 / 生气 / 委屈 / 惊讶 / 困惑 / 得意 / 疲惫 / 喜爱。想要英文/日文标注目前不支持,想要别的情绪也只能自改 - 单人 IP — 不支持多人合照、家庭 IP 集合、宠物合集
- 生成结果不可编辑 — 输出是 PNG/JPG,不能像 bento deck 那样导出 JSON 再改。要改只能重新跑一遍向导
- 没有"撤销某步重做"的强机制 — 大多数步可以重做,但如果你已经选了编号进入成品板阶段,想换风格就得从头来,token 也会重扣
- 不写用户肖像进 skill — 自定义风格参考图默认只用于当前任务,关掉会话就没了。如果想保留参考图,自己备份
8. 与本站的关系¶
跟 bento-ppt、voice-clone 一样归在「AI 工具/技能笔记」,但它不直接进站:
- 产物是图像资产(PNG/JPG),不是 HTML/JS
- 没必要硬塞
docs/assets/,那是给站内引用 - 真正合适的位置:
或者直接在某篇 Markdown 页面里用 <media> 标签贴出成品板(本指南未来可能会加示例)。
⚠️ AGENTS.md 提醒:
docs/下只放 Markdown 源 +docs/assets/,不收录任何audio/*.mp3之类的二进制资源。同理,贴纸 PNG 走docs/assets/stickers/别散落。
9. 验证清单(每跑一次过一遍)¶
- 风格确认:六款预览里至少有一款你愿意拿出来
- 特征一致:对比参考照,脸型 / 发型 / 气质对得上(不需要像,抽象就行)
- 成品板文字:9 个标注齐全且无错位 —
开心 / 大笑 / 生气 / 委屈 / 惊讶 / 困惑 / 得意 / 疲惫 / 喜爱(外加左侧正式头像标签) - 透明贴纸(若导出):背景真透明(可在画图工具里叠个色块确认,有些模型会留白边)
- 配色一致:头像和表情包的主色统一,不要出现"头像偏冷、表情包偏暖"的割裂
- token 消耗:对一下账户扣费是否在预期内(约 25–30 张图)
- 文件归档:成品板和贴纸分目录放,别散在
docs/ai/ -
zensical build --clean不报 broken link(如果你把它当页面引用)
10. 参考¶
- personal-ip-generator GitHub — skill 仓库,MIT 协议
- 风格约束详解:
references/style-presets.md - 完整流程说明:
references/plan-mode-wizard.md - 本站相关笔记:
- qiaomu-bento-ppt 使用指南 — 演示文稿 iframe 嵌入做法
- 语音克隆 TTS 方案指南 — 声音克隆 + TTS 完整方案对比