欢迎回来

登录 EAKE AI,继续您的智能之旅

忘记密码?
还没有账号?立即注册

宝鱼·知识漫画

宝鱼·知识漫画

本技能由 Jim Liu (宝玉) 开源,用于在 AI Agent 中处理AI 知识漫画生成。以下为官方技能说明文档:

支持多种美术风格和基调的知识漫画生成器。可创建包含精细分镜布局、支持批量图片生成的教育漫画。当用户要求创建「知识漫画」「教育漫画」「传记漫画(biography comic)」「教程漫画(tutorial comic)」或「逻辑喜剧式漫画(Logicomix-style comic)」时使用。

知识漫画生成器(Knowledge Comic Creator)

通过灵活的「美术风格 × 基调」组合,创作原创知识漫画。

用户输入工具(User Input Tools)

当本技能向用户提问时,请遵循以下工具选择规则(按优先级排序):

1. 优先使用内置用户输入工具:即当前 Agent 运行时暴露的 AskUserQuestionrequest_user_inputclarifyask_user 等同类工具。2. 回退方案:若不存在此类工具,则输出带编号的纯文本消息,请用户逐题回复所选编号或答案。3. 批量询问:若工具支持一次调用包含多个问题,则将所有相关问题合并为一次调用;若仅支持单个问题,则按优先级顺序逐个询问。

下文中的 AskUserQuestion 仅为具体示例——在其他运行时中请替换为本地等价工具。

图像生成工具(Image Generation Tools)

当本技能需要渲染图像时,请按以下顺序确定后端(backend):

1. 当前请求优先——若用户在当前消息中明确指定了某个后端,则直接使用它。2. 已保存的偏好——若 EXTEND.mdpreferred_image_backend 设置为当前可用的后端,则使用它。3. 自动选择(当偏好为 auto、未设置,或所固定的后端不可用时):- Codex(imagegen——首先检查你的可用技能/工具清单。若列表中存在名为 imagegen 的技能,说明你正在 Codex 环境中运行,必须使用它:通过 Skill 工具调用,参数为 skill: "imagegen",并传入已保存的提示词文件内容(另按 Codex imagegen 自身的参数传入输出路径和宽高比)。在该运行时中,Codex imagegen 是官方位图后端,优先于任何非原生技能(例如 baoyu-image-gen),除非用户已明确固定了不同的 preferred_image_backend。- 通过 codex exec 使用 Codex(codex-imagegen——若当前运行时未暴露原生 imagegen 技能,但 codex CLI 位于 PATH 且已执行 codex login,则通过 baoyu-image-gen --provider codex-cli 路由(首选);若 baoyu-image-gen 不可用,则直接调用随附的包装器。详细说明、参数及运行时发现流程见 [references/codex-imagegen.md](references/codex-imagegen.md)——仅当选中此分支时才加载该文件。- Cursor(GenerateImage——若运行时暴露了原生 GenerateImage 工具,说明你正在 Cursor 环境中运行,其优先级与 Codex imagegen 相同,高于任何非原生技能。有两点硬性注意事项:(a) 该工具没有宽高比参数——必须在作为 description 传入的提示词文本中明确写明目标宽高比/尺寸;(b) 它不接受输出目录——文件会保存到工具管理的路径,因此生成后需将文件复制/移动到本技能预期的输出路径(例如 outputs/.../NN-xxx.png)。参考图放在 reference_image_paths。- 其他运行时原生工具——若运行时暴露了其他原生图像工具(例如 Hermes 的 image_generate),以同样方式使用它。- 否则,若恰好只安装了一个非原生后端(例如 baoyu-image-gen),则使用它。- 否则(有多个非原生后端但没有运行时原生工具),向用户询问一次——可与其他初始问题一起批量提出。4. 若以上均不可用,请告知用户并询问如何继续。

⛔ 切勿用 SVG、HTML、canvas 或其他基于代码的渲染替代位图图像生成。Codex imagegen 自身的描述也指出,它应被用于「当输出应为位图资产而非仓库原生代码或矢量图形时」。若通过步骤 3 无法确定位图后端,则落到步骤 4 询问用户——切勿擅自输出 SVG、编写内联 <svg> 标记,或生成 HTML/CSS 图形作为替代。即使文章/章节看起来「像示意图」也同样适用:调用本规则的技能已经决定它需要的是位图图像。

⛔ 切勿通过在已生成的位图上覆盖绘制来修复渲染文字。不要使用 ImageMagick、Pillow、Canvas、SVG、HTML/CSS、OCR 脚本或任何其他程序化叠加方式,去遮盖、重写、擦除、描画或替换已生成漫画页面中的对白、音效、分格标签或任何其他文字。若文字有误或不清,请基于修正后的提示词重新生成,以更少或不含画面文字的方式重绘页面,或询问用户保留哪一个不完美的候选。

设置 preferred_image_backend: ask 会在每次运行时强制触发步骤 3 的询问,无论有哪些可用后端。用户可通过下方的 ## Changing Preferences 章节修改所固定的后端。

提示词文件要求(硬性):在调用任何后端之前,将每张图像的完整最终提示词写入 prompts/ 目录下的独立文件(命名规则:NN-{type}-[slug].md)。后端接收的是该提示词文件(或其内容);该文件作为可复现性记录,便于在不重新生成提示词的情况下切换后端。

上文中的具体工具名(imagegenGenerateImageimage_generatebaoyu-image-gen)仅为示例——在同一规则下请替换为本地等价工具。

批量生成策略(Batch Generation Policy)

当当前生成组的所有提示词文件均已保存并通过校验后,默认按批量方式生成图像。

优先级顺序:

1. 若所选后端存在原生批量/多任务接口,则使用之。每个任务必须保留各自的提示词文件、输出路径、宽高比、会话 ID 和直接参考图。2. 若没有原生批量接口,但运行时支持并行工具调用,则每次最多并发 generation_batch_size 张图像,默认值:4。若用户在当前消息中明确提出要求(如 --batch-size 4 或「并行4张一起生成」),则优先于 EXTEND.md。3. 若既无原生批量接口也无并行工具调用能力,则按顺序逐张生成。

规则:

  • 优先遵循工作流依赖:先生成 characters/characters.png,再生成以它为参考的页面。
  • 在所有选定的页面提示词文件落盘之前,切勿开始第一批页面生成。
  • 对失败项重试一次,但不重新生成已成功的项。
  • 不要仅为了并行渲染图像而使用子代理。子代理仅用于独立的提示词迭代或创意探索。

参考图像(Reference Images)

用户可以提供参考图,用于引导美术风格、配色、场景构图或主题。这与自动生成的角色表(Step 7.1)是相互独立的——两者可以共存:用户参考图引导外观,角色表则固定重复出现角色的身份特征。

接收方式:通过 --ref <files...> 参数,或当用户在对话中提供文件路径/粘贴图像时接收。

  • 文件路径 → 复制到漫画输出目录旁的 refs/NN-ref-{slug}.{ext}
  • 粘贴图像但无路径 → 按上文「用户输入工具」规则询问用户路径,或通过口头描述提取风格特征作为文字回退方案
  • 无参考图 → 跳过本小节

使用模式(针对每张参考图):

| 使用模式 | 效果 |

|-------|--------|

| direct | 将文件作为参考图传给后端,应用于每一页(或选定的页面) |

| style | 提取风格特征(线条处理、质感、氛围)并附加到每一页的提示词正文 |

| palette | 提取十六进制颜色并附加到每一页的提示词正文 |

当存在参考图时,在每页提示词文件的 frontmatter 中记录

references:
  - ref_id: 01
    filename: 01-ref-scene.png
    usage: direct

生成时

  • 校验每张被引用的文件确实存在于磁盘上
  • usage: direct 且所选后端接受多张参考图 → 通过后端的 ref 参数同时传入角色表(Step 7.2)和用户参考图;请先按 Step 7.1 的指引压缩图像,以避免载荷失败
  • 若后端仅接受一张参考图 → 对于有重复角色的页面优先使用角色表;将用户参考图的特征嵌入提示词正文
  • 对于 style/palette 用法 → 将提取的特征嵌入每一页的提示词文本(无论后端能力如何均适用)

选项(Options)

视觉维度(Visual Dimensions)

| 选项 | 取值 | 说明 |

|--------|--------|-------------|

| --art | ligne-claire(默认)、manga、realistic、ink-brush、chalk、minimalist | 美术风格 / 渲染技法 |

| --tone | neutral(默认)、warm、dramatic、romantic、energetic、vintage、action | 基调 / 氛围 |

| --layout | standard(默认)、cinematic、dense、splash、mixed、webtoon、four-panel | 分格排布 |

| --aspect | 3:4(默认,竖版)、4:3(横版)、16:9(宽屏) | 页面宽高比 |

| --lang | auto(默认)、zh、en、ja 等 | 输出语言 |

| --ref <files...> | 文件路径 | 应用于每一页的参考图,用于风格 / 配色 / 场景引导。见上文 [参考图像](#reference-images)。 |

| --batch-size <n> | 1-8 | 本次运行的临时页面生成批量大小。默认取 EXTEND.md 中的 generation_batch_size,否则为 4。 |

部分工作流选项(Partial Workflow Options)

| 选项 | 说明 |

|--------|-------------|

| --storyboard-only | 仅生成分镜脚本,跳过提示词和图像 |

| --prompts-only | 生成分镜脚本 + 提示词,跳过图像 |

| --images-only | 基于已有提示词目录生成图像 |

| --regenerate N | 仅重新生成指定的页面(例如 32,5,8) |

详见:[references/partial-workflows.md](references/partial-workflows.md)

美术、基调与预设目录(Art, Tone & Preset Catalogue)

  • 美术风格(6 种):ligne-clairemangarealisticink-brushchalkminimalist。完整定义见 references/art-styles/<style>.md
  • 基调(7 种):neutralwarmdramaticromanticenergeticvintageaction。完整定义见 references/tones/<tone>.md
  • 预设(5 种),除单纯的美术+基调之外还带有特殊规则:

| 预设 | 等价组合 | 特色要点 | |--------|-----------|------| | ohmsha | manga + neutral | 视觉隐喻、无大头说话镜头、道具揭示 | | wuxia | ink-brush + action | 气功特效、战斗画面、氛围感 | | shoujo | manga + romantic | 装饰元素、眼部细节、浪漫节拍 | | concept-story | manga + warm | 视觉符号系统、成长弧线、对白与动作平衡 | | four-panel | minimalist + neutral + four-panel layout | 起承转合结构、B&W + 点缀色、简笔画人物 |

完整规则见 references/presets/<preset>.md——选择某个预设时请加载对应文件。

  • 兼容性矩阵内容信号 → 预设对照表见 [references/auto-selection.md](references/auto-selection.md)。在步骤 2 中推荐组合之前,请先阅读该文件。

脚本目录(Script Directory)

重要:所有脚本均位于本技能的 scripts/ 子目录下。

Agent 执行说明:1. 将本 SKILL.md 文件所在目录路径记为 {baseDir} 2. 脚本路径 = {baseDir}/scripts/<script-name>.ts 3. 将本文档中所有 {baseDir} 替换为实际路径 4. 解析 ${BUN_X} 运行时:若已安装 bun → 使用 bun;若有 npx → 使用 npx -y bun;否则建议安装 bun

脚本参考

| 脚本 | 用途 |

|--------|---------|

| scripts/merge-to-pdf.ts | 将漫画页面合并为 PDF |

文件结构(File Structure)

输出目录:comic/{topic-slug}/

  • Slug:取主题的 2-4 个英文单词,kebab-case 短横线格式(例如 alan-turing-bio
  • 冲突:追加时间戳(例如 turing-story-20260118-143052

目录内容

| 文件 | 说明 |

|------|-------------|

| source-{slug}.{ext} | 源文件 |

| analysis.md | 内容分析 |

| storyboard.md | 含分格拆解的分镜脚本 |

| characters/characters.md | 角色定义 |

| characters/characters.png | 角色参考表 |

| prompts/NN-{cover|page}-[slug].md | 生成提示词 |

| NN-{cover|page}-[slug].png | 生成的图像 |

| {topic-slug}.pdf | 最终合并的 PDF |

语言处理(Language Handling)

检测优先级:1. --lang 参数(显式指定)2. EXTEND.md 中的 language 设置 3. 用户的对话语言 4. 源内容语言

规则:所有交互均使用用户的输入语言或已保存的语言偏好:

  • 分镜脚本大纲和场景描述
  • 图像生成提示词
  • 用户选择选项和确认提示
  • 进度更新、提问、错误信息和总结

技术术语保持英文。

工作流(Workflow)

进度清单(Progress Checklist)

Comic Progress:
- [ ] Step 1: Setup & Analyze
  - [ ] 1.1 Preferences (EXTEND.md) ⛔ BLOCKING
    - [ ] Found → load preferences → continue
    - [ ] Not found → run first-time setup → MUST complete before other steps
  - [ ] 1.2

(内容节选自官方 SKILL.md,完整说明见来源链接)

安装

本技能来源于官方仓库,可通过技能管理器安装:

# 安装到当前项目
npx skills add baoyu-comic

# 全局安装
npx skills add baoyu-comic -g

来源

安装指南

复制下方命令,在终端运行即可安装:

npx skills add baoyu-comic
npx skills add baoyu-comic -g
⚡ 一键安装到 GenHub

需已安装 GenHub 桌面端

使用指南

安装完成后,在对话框中直接使用此技能。

基本信息
作者 Jim Liu (宝玉) 分类 视觉创作 难度 Beginner 时长 1 hour
🛠️ 安装命令
npx skills add baoyu-comic
npx skills add baoyu-comic -g

发表评论