$npx -y skills add BAIKEMARK/happy-figure-skill --skill happy-figure-skillUse when 用户想根据论文、科研文档、研究文本、图注、开题/答辩材料或具备读图条件的参考图生成可复制的 AI 科研绘图提示词;触发场景包括论文配图、科研绘图、图形摘要、Graphical Abstract、机制图、技术路线图、实验装置图、模型架构图、多面板对比图、汇报总览图、参考图风格迁移、未知领域母版生成,或上传/引用 PDF、Word、LaTeX、Markdown、摘要、方法段、图注、课题说明、研究方案、参考图片。Also use when the user asks for scientific figure prompts, researc
| 1 | # happy-figure-skill |
| 2 | |
| 3 | 这个 Skill 专门把论文、开题材料、实验方案、研究说明或具备读图条件的参考图转换成可直接复制给 AI 绘图模型的科研绘图提示词。它只生成 prompt,不生成图片,不推荐草图工具,不展开矢量化或后处理流程。最终 prompt 和图中文字使用中文还是英文,由论文语言、投稿场景和用户需求决定。 |
| 4 | |
| 5 | ## 核心流程 |
| 6 | |
| 7 | 1. 解析用户提交的研究内容。 |
| 8 | - 如果用户给了文件路径,先运行 `scripts/extract_research_doc.py`。 |
| 9 | - 支持 `.docx`、`.pdf`、`.tex`、`.latex`、`.md`、`.txt`。可以尝试解析 `.doc`,但旧版 Word 文件依赖本地转换工具;失败时要求用户转换为 `.docx` 或粘贴相关文本。 |
| 10 | - 提取标题、摘要、方法、结果、图注、结论和候选上下文片段。 |
| 11 | - 如果用户给的是 LaTeX 文件夹,要求用户指定主 `.tex` 文件,不要自行猜入口。 |
| 12 | - 如果 PDF 或 Word 解析质量不高,要明确说明,只基于已成功提取的文本生成提示词。 |
| 13 | |
| 14 | 2. 判断绘图上下文。 |
| 15 | - 识别研究主题、学科领域、候选图类型、最适合可视化的论文片段。 |
| 16 | - 如果明显属于计算机/机器学习、材料与化学、生物与医学,优先使用领域母版。 |
| 17 | - 领域母版必须使用对应学科的发表语境:计算机类优先 ACM/IEEE/NeurIPS/ICML/CVPR/ACL/VLDB/KDD/WWW 等论文架构图的信息组织方式,不要套用 Nature/Science/Cell 的生物医学或材料科学视觉语言;材料化学、生物医学再使用各自对应期刊风格。 |
| 18 | - 对计算机/机器学习论文,不要把“领域会议风格”和“图面气质”混成一个选择;先分开判断两件事:**内容社区**(论文主题更接近哪个会议/期刊家族,决定信息组织方式)和 **视觉气质**(用户想要严格正文论文图、高级科研 graphical abstract、科研汇报/白皮书总览图,还是极简扁平矢量图)。 |
| 19 | - 如果用户未指定目标风格,不要直接锁死一个单一风格;先给出 2-3 个很短的“出图预期确认”候选,每个只写清“内容社区 + 视觉气质 + 适合什么结果”,并标注推荐项。目的是让用户在付费生图前确认大方向,不要写成长篇风格说明。 |
| 20 | - 如果用户提到“好看、质感、高级、出彩、精修、teaser、graphical abstract、海报、项目主页、展示图”等审美目标,优先推荐 **Premium Academic Graphical Abstract / 高级科研图形摘要** 视觉气质,而不是朴素的会议正文流程图;但内容社区仍然按论文主题选择。 |
| 21 | - 如果风格选择会显著改变最终 prompt,先让用户在候选风格中选择,此时不要同时输出最终绘图提示词;如果用户要求快速生成、“直接默认”或“只要 prompt”,才使用推荐项继续生成最终 prompt。 |
| 22 | - 图类型只作为表达任务规则,不替代领域母版。领域明确时,领域母版负责科学对象、学科语义和视觉语言;`references/figure-type-masters.md` 只作为适配层,约束表达目标、布局、区域、连接关系、可见文字和常见失败。 |
| 23 | - 只有当领域不明确、交叉学科明显或没有合适领域母版,且通用图类型结构不会丢失关键领域语义时,才单独使用图类型规则。 |
| 24 | - 如果现有领域母版无法覆盖用户学科,且直接使用通用图类型母版会丢失关键领域语义,读取 `references/adaptive-masters-and-reference-style.md`,使用 **模式 A:未知领域自适应母版**,先生成可复用的新领域母版草案,再基于草案生成本次最终绘图 prompt。 |
| 25 | - 如果用户提供参考图或要求“按这张图风格”,读取 `references/adaptive-masters-and-reference-style.md`,使用 **模式 B:参考图风格补丁**。风格补丁只能作为附加层,不能替代已选母版或新生成母版。 |
| 26 | - 只有当前模型具备读图能力时才分析参考图。若图片不可用或当前模型不能读图,要请用户补充参考图的简短描述,不要假装已经看过图片。 |
| 27 | - 如果多个选择都合理,先给推荐方案,只追问会显著改变最终 prompt 的问题。 |
| 28 | |
| 29 | 3. 只追问必要信息。 |
| 30 | 缺失信息会影响最终 prompt 时才问: |
| 31 | - 想画哪种图:技术路线图、实验装置图、机理示意图、多面板对比图、Graphical Abstract、开题/答辩/汇报总览图或其他。 |
| 32 | - 针对哪部分内容画:摘要、方法、结果、图注、全文、开题内容或用户指定片段。 |
| 33 | - 图中文字语言:中文、英文、中文提示词但英文标签、少文字。 |
| 34 | - 绘图模型:只有当模型选择会显著改变提示词语言、标签密度或结构约束时才追问;否则不要暂停,默认生成 gpt-image-2 / 强文字渲染模型友好的通用版本。 |
| 35 | |
| 36 | 4. 按需读取参考资料。 |
| 37 | - `references/domain-masters.md`:计算机/机器学习、材料与化学、生物与医学领域母版。 |
| 38 | - `references/figure-type-masters.md`:图类型融合规则,包括技术路线图、实验系统图、机制解释图、多面板比较图、图形摘要、汇报总览图和期刊封面图。 |
| 39 | - `references/model-cards.md`:不同绘图模型的轻量适配。 |
| 40 | - `references/language-strategy.md`:提示词语言与图中文字语言策略。 |
| 41 | - `references/prompt-quality-check.md`:最终检查与简短审查提醒。 |
| 42 | - `references/adaptive-masters-and-reference-style.md`:未知领域母版生成、参考图风格补丁和保存为 Skill 母版的协议。 |
| 43 | |
| 44 | 5. 生成一段最终绘图提示词。 |
| 45 | - 不要把领域母版和图类型规则逐段拼接。 |
| 46 | - 领域已覆盖时,以领域母版作为主要科学视觉语言。 |
| 47 | - 图类型规则只作为适配层,用来约束表达目标、布局、区域、连接关系、可见文字、科学边界和常见失败。 |
| 48 | - 写最终 prompt 前,先在内部形成 Figure Brief:图像目标、领域对象、图类型结构、区域/模块、连接关系、可见文字、科学边界和模型适配。 |
| 49 | - 如果领域与图类型发生冲突,优先级为:科学事实 > 用户明确要求 > 领域母版 > 图类型结构 > 模型适配 > 审美词。 |
| 50 | - 模型适配只能轻量补充,不覆盖领域视觉语言或科学约束。 |
| 51 | - 如果用户未指定模型,默认采用 gpt-image-2 / 强文字渲染模型友好的策略:保留能讲清楚流程的较丰富受控标签,而不是默认压缩成极少文字。 |
| 52 | - 必须把“图中所有可见文字只能使用以下内容...”写进最终绘图提示词内部。 |
| 53 | - 将 `{VISIBLE_TEXT_RULE}` 替换为 `references/language-strategy.md` 中与语言场景匹配的可见文字规则;面向用户的最终 prompt 中不要留下 `{VISIBLE_TEXT_RULE}` 或任何未填占位符。 |
| 54 | - Stage 1 Visual Schema 只作为内部规划。最终 prompt 仍然可以使用 `ZONE 1`、`ZONE 2`、`CONNECTIONS` 这类结构标题来组织绘图指令,但不能包含 `[Paste the full Visual Schema here]`、`[Insert extracted research context]`、`---BEGIN PROMPT---`、`---END PROMPT---` 或未替换的 `[Label ...]` 半成品脚手架。 |
| 55 | - 如果最终 prompt 使用 `ZONE` 这类结构标题,要通过可见文字规则说明这些只是提示词内部结构,除非显式列入可见标签清单,否则不能被画成图中文字。 |
| 56 | - 如果生成了自适应领域母版,要把新母版草案和本次最终 prompt 分开输出;只有当用户确认满意后,才询问是否保存为可复用 skill 母版。 |
| 57 | - 如果用户明确同意保存自适应领域母版,将其追加到 `references/domain-masters.md`,并在 Stage 2 保留 `{VISIBLE_TEXT_RULE}` 占位符。 |
| 58 | - 不要把“图中可出现的文字”做成用户需要额外复制的独立步骤。 |
| 59 | |
| 60 | ## 输出格式 |
| 61 | |
| 62 | 默认跟随用户交流语言输出:用户用中文提问时,使用中文交流;用户用英文提问时,使用英文交流。最终绘图 prompt 和图中文字语言不简单跟随交流语言,而是按论文语言、投稿场景、用户要求和 `references/language-strategy.md` 的规则决定。 |
| 63 | |
| 64 | 当需要用户先确认出图预期时,只输出 `## 文档理解`、`## 出图预期确认` 和必要的 `## 选用依据`,等待用户选择后再输出最终绘图提示词。只有在用户要求快速生成、直接默认或只要 prompt 时,才跳过等待并使用推荐项输出最终 prompt。 |
| 65 | |
| 66 | ```markdown |
| 67 | ## 文档理解 |
| 68 | [3-6 条:研究主题、领域判断、选用片段、图类型、绘图模型、图中文字语言] |
| 69 | |
| 70 | ## 出图预期确认 |
| 71 | [当用户未指定目标风格,且风格会显著影响付费生图结果时列出 2-3 个短候选。每项不超过 2 行,包含:内容社区 + 视觉气质 + 适合什么结果;标注推荐项。让用户快速选方向,不写长篇解释。] |
| 72 | |
| 73 | ## 选用依据 |
| 74 | [简要列出使用了哪些摘要、方法、结果、图注或候选片段] |
| 75 | |
| 76 | ## 自适应领域母版草案 |
| 77 | [仅当现有领域母版无法覆盖并生成了新领域母版时输出。包含适合场景、领域图示特征、Stage 1 Visual Schema、Stage 2 Rendering Prompt、可替换变量、稳定约束和质检清单。] |
| 78 | |
| 79 | ## 参考图风格补充 |
| 80 | [ |