{/* This page is auto-generated from the skill's SKILL.md by website/scripts/generate-skill-docs.py. Edit the source SKILL.md, not this page. */}
Baoyu Article Illustrator
文章配图:类型 × 风格 × 配色的一致性。
Skill 元数据
| 来源 | 可选 — 通过 hermes skills install official/creative/baoyu-article-illustrator 安装 |
| 路径 | optional-skills/creative/baoyu-article-illustrator |
| 版本 | 1.57.0 |
| 作者 | 宝玉 (JimLiu) |
| 许可证 | MIT |
| 平台 | linux, macos, windows |
| 标签 | article-illustration, creative, image-generation |
参考:完整 SKILL.md
以下是 Hermes 在触发本 skill 时加载的完整 skill 定义。这是 agent 在 skill 激活时所看到的指令内容。
文章配图助手
为适配 Hermes Agent 的工具生态,改编自 baoyu-article-illustrator。
分析文章、识别配图位置,以类型 × 风格 × 配色的一致性生成图片。
何时使用
当用户要求为文章配图、给文章加图、为内容生成插图,或说出"为文章配图"、"illustrate article"、"add images"等说法时,触发本 skill。用户提供一篇文章(文件路径或粘贴的内容),并可指定类型、风格、配色或密度。
三个维度
| 维度 | 控制 | 示例 |
|---|---|---|
| 类型(Type) | 信息结构 | infographic, scene, flowchart, comparison, framework, timeline |
| 风格(Style) | 渲染手法 | notion, warm, minimal, blueprint, watercolor, elegant |
| 配色(Palette) | 配色方案(可选) | macaron, warm, neon——覆盖风格默认色 |
自由组合:type=infographic, style=vector-illustration, palette=macaron。
或用预设:edu-visual → 一次性给出 类型 + 风格 + 配色。见 style-presets.md。
类型
| 类型 | 最适合 |
|---|---|
infographic | 数据、指标、技术 |
scene | 叙事、情感 |
flowchart | 流程、工作流 |
comparison | 并排对比、多个选项 |
framework | 模型、架构 |
timeline | 历史、演进 |
风格
核心风格、完整画廊以及 类型 × 风格 兼容性见 references/styles.md。
输出结构
{output-dir}/
├── source-{slug}.{ext} # Only for pasted content
├── outline.md
├── prompts/
│ └── NN-{type}-{slug}.md
└── NN-{type}-{slug}.png
默认输出目录:
| 输入 | 输出目录 | Markdown 插入路径 |
|---|---|---|
| 文章文件路径 | {article-dir}/imgs/ | imgs/NN-{type}-{slug}.png |
| 粘贴的内容 | illustrations/{topic-slug}/(当前工作目录) | illustrations/{topic-slug}/NN-{type}-{slug}.png |
若用户要求不同布局(例如图片放在文章旁,或用 illustrations/ 子目录),照办。
Slug:2-4 个词,kebab-case。冲突:追加 -YYYYMMDD-HHMMSS。
核心原则
- 把概念可视化,而非把比喻画出来 —— 若文章用了比喻(例如"电锯切西瓜"),画底层概念,不画字面图像。
- 标签用文章里的数据 —— 真实数字、术语和引文,不是通用占位符。
- 提示词文件是可复现记录 —— 任何图片生成之前,每张插图都必须在
prompts/下有一个已保存的提示词文件。 - 剥离机密 —— 写盘之前,扫描源内容中的 API key、token 或凭据。
工作流
- [ ] Step 1: Detect reference images (if provided)
- [ ] Step 2: Analyze content
- [ ] Step 3: Confirm settings (clarify tool)
- [ ] Step 4: Generate outline
- [ ] Step 5: Generate prompts
- [ ] Step 6: Generate images (image_generate)
- [ ] Step 7: Finalize
第 1 步:检测参考图(若提供)
若用户提供参考图(内联粘贴的路径、附件或 URL):
- 对每张参考图,带路径/URL 和一个询问风格、配色、构图、主体的问题调用
vision_analyze。通过write_file把返回的描述记到{output-dir}/references/NN-ref-{slug}.md。 - 不要试图用
write_file/read_file复制二进制——它们只处理文本。若想留一份本地副本存档,用terminal(cp "$src" "{output-dir}/references/NN-ref-{slug}.{ext}")。skill 本身从不需要读二进制;它靠视觉描述工作。 - 由于
image_generate不接受图片输入,视觉描述会在第 5 步嵌入提示词。
完整流程:references/workflow.md。
第 2 步:分析
| 分析 | 输出 |
|---|---|
| 内容类型 | 技术 / 教程 / 方法论 / 叙事 |
| 目的 | information / visualization / imagination |
| 核心论点 | 2-5 个要点 |
| 位置 | 插图能增值之处 |
读源(文件路径 → read_file,或粘贴的文本),用 write_file 把分析写到 {output-dir}/analysis.md。
完整流程:references/workflow.md。
第 3 步:确认设置
用 clarify 工具。把相互独立的问题放进一个 questions 数组(最多 5 个)。用户请求里已有答案的问题跳过。
| 顺序 | 问题 | 选项 |
|---|---|---|
| Q1 | 预设还是类型 | [推荐预设]、[备选预设],或手动:infographic, scene, flowchart, comparison, framework, timeline, mixed |
| Q2 | 密度 | minimal (1-2)、balanced (3-5)、per-section(推荐)、rich (6+) |
| Q3 | 风格(若 Q1 选了预设则跳过) | [推荐]、minimal-flat、sci-fi、hand-drawn、editorial、scene、poster |
| Q4 | 配色(可选) | 默认(风格色)、macaron、warm、neon |
| Q5 | 语言(仅当文章语言不明确时) | 文章语言 / 用户语言 |
不要连续问超过 2-3 个 clarify 问题。若用户已在请求里指定,全部跳过。
完整流程:references/workflow.md。
第 4 步:生成大纲 → outline.md
用 write_file 保存 {output-dir}/outline.md,带 frontmatter(type、density、style、palette、image_count),每张插图一条:
## Illustration 1
**Position**: [section/paragraph]
**Purpose**: [why]
**Visual Content**: [what to show]
**Filename**: 01-infographic-concept-name.png
完整模板:references/workflow.md。
第 5 步:生成提示词
硬性要求:任何图片生成之前,每张插图都必须有一个已保存的提示词文件——提示词文件就是可复现记录。
对每张插图:
- 按 references/prompt-construction.md 建一个提示词文件。
- 用
write_file带 YAML frontmatter 保存到{output-dir}/prompts/NN-{type}-{slug}.md。 - 提示词必须使用类型专属模板,带结构化分区(ZONES / LABELS / COLORS / STYLE / ASPECT)。
- LABELS 必须包含文章专属数据:真实数字、术语、指标、引文。
- 按提示词 frontmatter 处理参考(
direct/style/palette)——对direct用法,把参考图的文字描述嵌进提示词(因为image_generate不接受参考图输入)。
第 6 步:生成图片
对每个提示词文件:
- 调用
image_generate(prompt=..., aspect_ratio=...)。image_generate返回一个含图片 URL 的 JSON 结果;它不写盘,也不接受输出路径。 - 把提示词的
ASPECT映射到image_generate的枚举:16:9→landscape,9:16→portrait,1:1→square。自定义比例 → 最近的命名宽高比。 - 通过
terminal把返回的 URL 下载到{output-dir}/NN-{type}-{slug}.png(例如curl -sSL -o "{output-dir}/NN-{type}-{slug}.png" "{url}")。 - 生成失败时自动重试一次。
注意:底层图片生成后端由用户配置(默认:FAL FLUX 2 Klein 9B),agent 无法通过 image_generate 选择。不要把模型名写进提示词指望它路由。
第 7 步:收尾
在对应段落后插入 。Alt 文本:用文章语言的简洁描述。
汇报:
Article Illustration Complete!
Article: [path] | Type: [type] | Density: [level] | Style: [style] | Palette: [palette or default]
Images: X/N generated
修改
| 操作 | 步骤 |
|---|---|
| 编辑 | 更新提示词 → 重新生成 → 更新引用 |
| 新增 | 定位 → 提示词 → 生成 → 更新大纲 → 插入 |
| 删除 | 删除文件 → 移除引用 → 更新大纲 |
参考
| 文件 | 内容 |
|---|---|
| references/workflow.md | 详细流程 |
| references/usage.md | 调用示例 |
| references/styles.md | 风格画廊 + 配色画廊 |
| references/style-presets.md | 预设快捷方式(类型 + 风格 + 配色) |
| references/prompt-construction.md | 提示词模板 |
常见坑
- 数据完整性至高无上 —— 绝不概括、改写或篡改源统计数字。"73% increase" 就保持 "73% increase"。
- 剥离机密 —— 写任何输出文件前,扫描源内容中的 API key、token 或凭据。
- 不要把比喻画成字面图像 —— 把底层概念可视化。
- 提示词文件是强制的 —— 没有已保存的提示词文件就不生成图片。这个文件让你日后能重新生成或切换后端。
image_generate宽高比 —— 工具支持landscape、portrait、square。自定义比例映射到最近选项。image_generate返回 URL,不是本地文件 —— 在往文章里插入本地图片路径前,务必通过terminal(curl)下载。- agent 不能选后端 ——
image_generate用用户配置的模型(默认:FAL FLUX 2 Klein 9B)。不要往提示词里写"use <model> to generate this"指望它路由。