$npx -y skills add Supreme-Ultimate/novel-to-script-team --skill knowledge-curation-skill知识收编技能。将 sources 中知识去重、路由、吸收进 team 内部 references 与 knowledge。
| 1 | # 知识收编技能 |
| 2 | |
| 3 | ## 必读 |
| 4 | 1. `../../references/index.md` |
| 5 | 2. `../../references/07-knowledge-curation.md` |
| 6 | 3. `../../knowledge/canon-map.md` |
| 7 | |
| 8 | ## 执行模式 |
| 9 | |
| 10 | ### 模式1:标准收编(~ingest) |
| 11 | 扫描 `sources/` 目录,执行知识整合。 |
| 12 | |
| 13 | ### 模式2:批量收编待处理知识(~ingest-pending) |
| 14 | |
| 15 | **触发条件**:收到 `~ingest-pending` 指令 |
| 16 | |
| 17 | **执行流程**: |
| 18 | |
| 19 | #### Step 1:扫描待处理目录 |
| 20 | ```bash |
| 21 | ls -la ./pending-knowledge/ |
| 22 | ``` |
| 23 | - 列出所有待处理文件 |
| 24 | - 识别文件类型(.txt, .md, 目录等) |
| 25 | |
| 26 | #### Step 2:逐个分析文件 |
| 27 | 对每个文件执行: |
| 28 | 1. 读取文件内容 |
| 29 | 2. 提取核心知识点(3-10个) |
| 30 | 3. **收编前强制5问**(必须明确回答,否则拒绝收编): |
| 31 | - Q1:哪个 agent 会用到这个知识?(必须指定具体 agent 名称,如 script-writer、storyboard-artist) |
| 32 | - Q2:在哪个阶段会用到?(必须指定具体工作流阶段,如 ~write、~storyboard-seedance) |
| 33 | - Q3:现有知识库是否已覆盖?(如已覆盖且无明显增量,拒绝收编)。必须执行 `grep -rn "关键概念1\|关键概念2" references/*.md`,记录命中文件:行号:摘要。未执行 grep = 自动拒绝 |
| 34 | - Q4:目标文件行数是否安全?(执行 `wc -l <目标文件>`,超 800 行 [WARNING],超 1200 行 [OVERSIZED] 禁止追加) |
| 35 | - Q5:是否存在多文件命中?(执行 `grep -l "核心概念" references/*.md`,命中 2+ 文件必须选择主文件并说明理由) |
| 36 | 4. 判断知识类型: |
| 37 | - 方法论(归属 references/) |
| 38 | - 执行规则(归属 skills/) |
| 39 | - 案例示例(归属 sources/) |
| 40 | - 拒绝收编(无法明确使用场景) |
| 41 | |
| 42 | #### 分级示例参考 |
| 43 | |
| 44 | **A级(references/ 核心区)**: |
| 45 | - ✅ 「节奏呼吸感四步法」→ ref/16(≥2 agent 用,高频) |
| 46 | - ✅ 「共情四步法」→ ref/14(情绪设计核心) |
| 47 | - ❌ 「70个女频梗库」→ 太具体,应为 C 级 |
| 48 | |
| 49 | **B级(references/ 分镜区)**: |
| 50 | - ✅ 「Seedance 景别运镜组合」→ ref/11 |
| 51 | - ✅ 「Beat Board 九宫格方法」→ ref/09 |
| 52 | |
| 53 | **C级(sources/)**: |
| 54 | - ✅ 「韩国编剧案例分析」→ sources/screenwriting-methodology/ |
| 55 | - ✅ 「标题起名30公式」→ sources/screenwriting-methodology/ |
| 56 | |
| 57 | **D级(references/ 进阶区)**: |
| 58 | - ✅ 「色彩心理学补充」→ ref/15 |
| 59 | - ✅ 「光影叙事新技法」→ ref/17 |
| 60 | |
| 61 | **拒绝**: |
| 62 | - ❌ AI 写作 prompt(与工作流无关) |
| 63 | - ❌ 行业报告/职业规划(无 agent 使用场景) |
| 64 | - ❌ 纯理论无可执行规则 |
| 65 | |
| 66 | #### Step 3:知识路由分析 |
| 67 | 为每个知识点生成路由表: |
| 68 | ```markdown |
| 69 | | 知识点 | 归属位置 | 集成方式 | 优先级 | 理由 | |
| 70 | |--------|---------|---------|--------|------| |
| 71 | | ... | references/XX.md | 新增/补充/替换 | A/B/C | ... | |
| 72 | ``` |
| 73 | |
| 74 | #### Step 3.5:批量检查点(每 15 个文件) |
| 75 | |
| 76 | 每处理 15 个文件后输出中间报告: |
| 77 | ```markdown |
| 78 | ### 批量检查点 #N |
| 79 | |
| 80 | **本批文件**:[文件列表] |
| 81 | **VERIFIED**:X 个 |
| 82 | **FAILED**:Y 个 |
| 83 | **累计进度**:已处理 M / 总计 T |
| 84 | |
| 85 | **暂停条件检查**: |
| 86 | - [ ] FAILED >= 3 → 暂停并报告 |
| 87 | - [ ] 目标文件 OVERSIZED → 暂停并报告 |
| 88 | - [ ] 主题冲突 → 暂停并报告 |
| 89 | ``` |
| 90 | |
| 91 | #### Step 4:执行集成 |
| 92 | - 使用 Edit 工具更新对应文件 |
| 93 | - 遵循"补充优先、替换慎重"原则 |
| 94 | - 保持文档结构一致性 |
| 95 | - 每次 Edit 后立即执行 `grep -n "唯一短语" <文件>` 确认写入 |
| 96 | - 验证成功输出:[VERIFIED] Edit <文件> |
| 97 | - 验证失败重试一次,仍失败标记 [FAILED] Edit <文件> <原因> |
| 98 | |
| 99 | #### Step 5:记录集成信息(分区存储) |
| 100 | |
| 101 | **月度详情文件** `knowledge/absorption-map-YYYY-MM.md`: |
| 102 | ```markdown |
| 103 | ## YYYY-MM-DD:批量收编 pending-knowledge |
| 104 | |
| 105 | **来源文件**: |
| 106 | - pending-knowledge/1.txt |
| 107 | - pending-knowledge/2.txt |
| 108 | - ... |
| 109 | |
| 110 | **集成位置**: |
| 111 | - references/XX.md:新增YY章节 |
| 112 | - skills/ZZ/SKILL.md:补充AA规则 |
| 113 | - ... |
| 114 | |
| 115 | **集成方式**:补充/新增/替换 |
| 116 | **优先级**:A/B/C级 |
| 117 | ``` |
| 118 | |
| 119 | **索引文件** `knowledge/absorption-map-index.md`: |
| 120 | - 仅追加一行摘要:`| YYYY-MM-DD | N个文件 | A级×M, B级×N, C级×P | 详见 absorption-map-YYYY-MM.md |` |
| 121 | - 更新统计:总收编数、本月收编数、拒绝数 |
| 122 | |
| 123 | #### Step 6:移动已处理文件 |
| 124 | ```bash |
| 125 | # 创建日期目录 |
| 126 | mkdir -p ./sources/pending-ingested/YYYY-MM-DD/ |
| 127 | mkdir -p ./sources/pending-ingested/YYYY-MM-DD/rejected/ |
| 128 | |
| 129 | # 移动成功收编的文件 |
| 130 | mv ./pending-knowledge/[文件名] ./sources/pending-ingested/YYYY-MM-DD/ |
| 131 | |
| 132 | # 移动拒绝收编的文件 |
| 133 | mv ./pending-knowledge/[文件名] ./sources/pending-ingested/YYYY-MM-DD/rejected/ |
| 134 | ``` |
| 135 | |
| 136 | **移动规则**: |
| 137 | - ✅ 成功收编:移动到 `sources/pending-ingested/[日期]/` |
| 138 | - ❌ 拒绝收编:移动到 `sources/pending-ingested/[日期]/rejected/`,并在报告中说明原因 |
| 139 | - 📁 子目录:整体移动,保持结构 |
| 140 | |
| 141 | #### Step 7:输出收编报告 |
| 142 | ```markdown |
| 143 | ## 批量收编报告 |
| 144 | |
| 145 | ### 处理统计 |
| 146 | - 总文件数:X |
| 147 | - 成功收编:Y |
| 148 | - 拒绝收编:Z |
| 149 | - 已移动文件:X(成功Y + 拒绝Z) |
| 150 | |
| 151 | ### 成功收编列表 |
| 152 | 1. [文件名] → [集成位置] → 已移动到 sources/pending-ingested/YYYY-MM-DD/ |
| 153 | - 使用 agent:[agent名称] |
| 154 | - 使用阶段:[工作流阶段] |
| 155 | 2. ... |
| 156 | |
| 157 | ### 拒绝收编列表 |
| 158 | 1. [文件名]:[拒绝原因] → 已移动到 sources/pending-ingested/YYYY-MM-DD/rejected/ |
| 159 | - 原因示例:无法明确使用 agent / 与现有知识重复 / 与工作流无关 |
| 160 | 2. ... |
| 161 | |
| 162 | ### 知识集成摘要 |
| 163 | - 新增章节:X个 |
| 164 | - 补充内容:Y处 |
| 165 | - 替换内容:Z处 |
| 166 | ``` |
| 167 | |
| 168 | #### Step 8:健康检查 |
| 169 | |
| 170 | 收编报告末尾附加健康报告: |
| 171 | |
| 172 | ```markdown |
| 173 | ### 健康检查报告 |
| 174 | |
| 175 | | 文件 | 行数 | 状态 | 建议 | |
| 176 | |------|------|------|------| |
| 177 | | references/XX.md | NNN | OK/WARNING/OVERSIZED | — / 评估拆分 / 必须拆分 | |
| 178 | |
| 179 | ### 重叠检测 |
| 180 | - grep -l "核心概念A" references/*.md → [命中文件列表] |
| 181 | - 如命中 2+ 文件,标注需要归属确认 |
| 182 | ``` |
| 183 | |
| 184 | ## 输出 |
| 185 | 1. `../../knowledge/source-registry.md` |
| 186 | 2. `../../knowledge/absorption-map-index.md` |
| 187 | 3. `../../knowledge/canon-map.md` |
| 188 | 4. 批量收编报告(输出到终端) |
| 189 | |
| 190 | ## 成功标准 |
| 191 | 1. 新增来源已注册 |
| 192 | 2. 每个来源都有归属 skill |
| 193 | 3. 吸收结论可追溯 |
| 194 | 4. **批量收编模式**:所有文件已移动(成功收编 → `sources/pending-ingested/[日期]/`,拒绝收编 → `sources/pending-ingested/[日期]/rejected/`) |
| 195 | 5. **收编前强制5问**:每个文件都明确回答了使用 agent、使用阶段、是否重复、目标文件行数、多文件命中 |
| 196 | 6. **执行验证**:每个 Edit/mv 操作有 [VERIFIED] 标记 |
| 197 | 7. **5问完整**:每个文件的5问记录完整,Q3 含 grep 证据 |
| 198 | 8. **健康检查**:报告末尾包含健康检查报告 |
| 199 | 9. **零 FAILED**:所有操作 VERIFIED,或 FAILED 已说明原因并标记 |
| 200 | |
| 201 | ## 注意事项 |
| 202 | |
| 203 | ### 冲突处理 |
| 204 | - 如果新知识与现有知识冲突,标注为"需人工判断" |
| 205 | - 不要自动替换现有的核心规则 |
| 206 | - 优先补充而非替换 |
| 207 | |
| 208 | ### 文件移动安全 |
| 209 | - 移动前确认文件已成功集成 |
| 210 | - 保留原文件名,便于追溯 |
| 211 | - 使用日期目录分组,便于管理 |
| 212 | |
| 213 | ### 质量控制 |
| 214 | - 只收编可执行的知识(能执行 > 能解释) |
| 215 | - 只收编可验证的知识(能验证 > 能感受) |
| 216 | - 拒绝一次性灵感,只收编可复用的规则 |