{/* This page is auto-generated from the skill's SKILL.md by website/scripts/generate-skill-docs.py. Edit the source SKILL.md, not this page. */}

Baoyu Article Illustrator

文章配图:类型 × 风格 × 配色的一致性。

Skill 元数据

来源可选 — 通过 hermes skills install official/creative/baoyu-article-illustrator 安装
路径optional-skills/creative/baoyu-article-illustrator
版本1.57.0
作者宝玉 (JimLiu)
许可证MIT
平台linux, macos, windows
标签article-illustration, creative, image-generation

参考:完整 SKILL.md

INFO

以下是 Hermes 在触发本 skill 时加载的完整 skill 定义。这是 agent 在 skill 激活时所看到的指令内容。

文章配图助手

为适配 Hermes Agent 的工具生态,改编自 baoyu-article-illustrator。

分析文章、识别配图位置,以类型 × 风格 × 配色的一致性生成图片。

何时使用

当用户要求为文章配图、给文章加图、为内容生成插图,或说出"为文章配图"、"illustrate article"、"add images"等说法时,触发本 skill。用户提供一篇文章(文件路径或粘贴的内容),并可指定类型、风格、配色或密度。

三个维度

维度控制示例
类型(Type)信息结构infographic, scene, flowchart, comparison, framework, timeline
风格(Style)渲染手法notion, warm, minimal, blueprint, watercolor, elegant
配色(Palette)配色方案(可选)macaron, warm, neon——覆盖风格默认色

自由组合:type=infographic, style=vector-illustration, palette=macaron。

或用预设:edu-visual → 一次性给出 类型 + 风格 + 配色。见 style-presets.md。

类型

类型最适合
infographic数据、指标、技术
scene叙事、情感
flowchart流程、工作流
comparison并排对比、多个选项
framework模型、架构
timeline历史、演进

风格

核心风格、完整画廊以及 类型 × 风格 兼容性见 references/styles.md。

输出结构

{output-dir}/
├── source-{slug}.{ext}    # Only for pasted content
├── outline.md
├── prompts/
│   └── NN-{type}-{slug}.md
└── NN-{type}-{slug}.png

默认输出目录:

输入输出目录Markdown 插入路径
文章文件路径{article-dir}/imgs/imgs/NN-{type}-{slug}.png
粘贴的内容illustrations/{topic-slug}/(当前工作目录)illustrations/{topic-slug}/NN-{type}-{slug}.png

若用户要求不同布局(例如图片放在文章旁,或用 illustrations/ 子目录),照办。

Slug:2-4 个词,kebab-case。冲突:追加 -YYYYMMDD-HHMMSS。

核心原则

  • 把概念可视化,而非把比喻画出来 —— 若文章用了比喻(例如"电锯切西瓜"),画底层概念,不画字面图像。
  • 标签用文章里的数据 —— 真实数字、术语和引文,不是通用占位符。
  • 提示词文件是可复现记录 —— 任何图片生成之前,每张插图都必须在 prompts/ 下有一个已保存的提示词文件。
  • 剥离机密 —— 写盘之前,扫描源内容中的 API key、token 或凭据。

工作流

- [ ] Step 1: Detect reference images (if provided)
- [ ] Step 2: Analyze content
- [ ] Step 3: Confirm settings (clarify tool)
- [ ] Step 4: Generate outline
- [ ] Step 5: Generate prompts
- [ ] Step 6: Generate images (image_generate)
- [ ] Step 7: Finalize

第 1 步:检测参考图(若提供)

若用户提供参考图(内联粘贴的路径、附件或 URL):

  1. 对每张参考图,带路径/URL 和一个询问风格、配色、构图、主体的问题调用 vision_analyze。通过 write_file 把返回的描述记到 {output-dir}/references/NN-ref-{slug}.md。
  2. 不要试图用 write_file / read_file 复制二进制——它们只处理文本。若想留一份本地副本存档,用 terminal(cp "$src" "{output-dir}/references/NN-ref-{slug}.{ext}")。skill 本身从不需要读二进制;它靠视觉描述工作。
  3. 由于 image_generate 不接受图片输入,视觉描述会在第 5 步嵌入提示词。

完整流程:references/workflow.md。

第 2 步:分析

分析输出
内容类型技术 / 教程 / 方法论 / 叙事
目的information / visualization / imagination
核心论点2-5 个要点
位置插图能增值之处

读源(文件路径 → read_file,或粘贴的文本),用 write_file 把分析写到 {output-dir}/analysis.md。

完整流程:references/workflow.md。

第 3 步:确认设置

用 clarify 工具。把相互独立的问题放进一个 questions 数组(最多 5 个)。用户请求里已有答案的问题跳过。

顺序问题选项
Q1预设还是类型[推荐预设]、[备选预设],或手动:infographic, scene, flowchart, comparison, framework, timeline, mixed
Q2密度minimal (1-2)、balanced (3-5)、per-section(推荐)、rich (6+)
Q3风格(若 Q1 选了预设则跳过)[推荐]、minimal-flat、sci-fi、hand-drawn、editorial、scene、poster
Q4配色(可选)默认(风格色)、macaron、warm、neon
Q5语言(仅当文章语言不明确时)文章语言 / 用户语言

不要连续问超过 2-3 个 clarify 问题。若用户已在请求里指定,全部跳过。

完整流程:references/workflow.md。

第 4 步:生成大纲 → outline.md

用 write_file 保存 {output-dir}/outline.md,带 frontmatter(type、density、style、palette、image_count),每张插图一条:

## Illustration 1
**Position**: [section/paragraph]
**Purpose**: [why]
**Visual Content**: [what to show]
**Filename**: 01-infographic-concept-name.png

完整模板:references/workflow.md。

第 5 步:生成提示词

硬性要求:任何图片生成之前,每张插图都必须有一个已保存的提示词文件——提示词文件就是可复现记录。

对每张插图:

  1. 按 references/prompt-construction.md 建一个提示词文件。
  2. 用 write_file 带 YAML frontmatter 保存到 {output-dir}/prompts/NN-{type}-{slug}.md。
  3. 提示词必须使用类型专属模板,带结构化分区(ZONES / LABELS / COLORS / STYLE / ASPECT)。
  4. LABELS 必须包含文章专属数据:真实数字、术语、指标、引文。
  5. 按提示词 frontmatter 处理参考(direct/style/palette)——对 direct 用法,把参考图的文字描述嵌进提示词(因为 image_generate 不接受参考图输入)。

第 6 步:生成图片

对每个提示词文件:

  1. 调用 image_generate(prompt=..., aspect_ratio=...)。image_generate 返回一个含图片 URL 的 JSON 结果;它不写盘,也不接受输出路径。
  2. 把提示词的 ASPECT 映射到 image_generate 的枚举:16:9 → landscape,9:16 → portrait,1:1 → square。自定义比例 → 最近的命名宽高比。
  3. 通过 terminal 把返回的 URL 下载到 {output-dir}/NN-{type}-{slug}.png(例如 curl -sSL -o "{output-dir}/NN-{type}-{slug}.png" "{url}")。
  4. 生成失败时自动重试一次。

注意:底层图片生成后端由用户配置(默认:FAL FLUX 2 Klein 9B),agent 无法通过 image_generate 选择。不要把模型名写进提示词指望它路由。

第 7 步:收尾

在对应段落后插入 ![description](https://github.com/NousResearch/hermes-agent/blob/main/optional-skills/creative/baoyu-article-illustrator/{relative-path}/NN-{type}-{slug}.png)。Alt 文本:用文章语言的简洁描述。

汇报:

Article Illustration Complete!
Article: [path] | Type: [type] | Density: [level] | Style: [style] | Palette: [palette or default]
Images: X/N generated

修改

操作步骤
编辑更新提示词 → 重新生成 → 更新引用
新增定位 → 提示词 → 生成 → 更新大纲 → 插入
删除删除文件 → 移除引用 → 更新大纲

参考

文件内容
references/workflow.md详细流程
references/usage.md调用示例
references/styles.md风格画廊 + 配色画廊
references/style-presets.md预设快捷方式(类型 + 风格 + 配色)
references/prompt-construction.md提示词模板

常见坑

  1. 数据完整性至高无上 —— 绝不概括、改写或篡改源统计数字。"73% increase" 就保持 "73% increase"。
  2. 剥离机密 —— 写任何输出文件前,扫描源内容中的 API key、token 或凭据。
  3. 不要把比喻画成字面图像 —— 把底层概念可视化。
  4. 提示词文件是强制的 —— 没有已保存的提示词文件就不生成图片。这个文件让你日后能重新生成或切换后端。
  5. image_generate 宽高比 —— 工具支持 landscape、portrait、square。自定义比例映射到最近选项。
  6. image_generate 返回 URL,不是本地文件 —— 在往文章里插入本地图片路径前,务必通过 terminal(curl)下载。
  7. agent 不能选后端 —— image_generate 用用户配置的模型(默认:FAL FLUX 2 Klein 9B)。不要往提示词里写 "use <model> to generate this" 指望它路由。