## 第一阶段 · 搭骨架 ### 步骤 | 小步 | 做什么 | 产出 | | ------- | ----------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------- | --------------------------- | | **1.1** | **读懂 + 判断有几个工序** —— 通读原文(含配图)想清楚:(a) 这篇案例里有**几条独立的做法**(一条还是多条);多条时,把每条的名字、最终产物、大概几步、属于什么工艺各列出来。(b) 认出最终产物、用到的外部工具、以及那些"没明说但少不了"的前置准备。 | `understanding.md`(按工序分章节写) | | **1.2** | **切步骤 + 填单步骨架** —— 一次性写出 `workflow.json` 骨架 | `workflow.json`(骨架版) | | **1.3** | **把数据流连起来** —— 给每个输入输出补上"来源/去处":输入写 `← 上游某输出的编号`(如 `← s2o1`)、`← 工序输入`、`← 某编号[i]`(循环里逐个取);输出写 `→ sN`、`→ 某列表.追加`。连完自查:每个输入引用的编号都能在前面找到对应输出。连错就回 1.2 改。几十处要连时用 `wf-patch.py` 一次过(见下),别写脚本硬塞。 | `workflow.json`(补好"来源/去处") | --- ## workflow.json 整体结构 一个 `workflow.json` 描述一篇案例,里面可以有一个或多个工序(比如一篇文章同时讲了"简单做法"和"进阶做法",那就是两个工序)。 ``` { "source": 原帖信息, # 平台/作者/日期/标题/摘要;正文和配图由 --source-input 自动补 "procedures": [ 一个或多个工序 ] # 只有一个工序时也用长度为 1 的数组 } # page_title 不写进文件,由第三阶段 --page-title 命令传入 ``` 每个**工序**长这样: ``` { "id": "p1", "name": 工序名字, "purpose": 一句话说明这个工序在做什么, "category": 类别(产物创造 / 资产建设 / 自动化 / 分析 / 学习), "platform": 平台, "author": 作者, "declarations": 这个工序需要哪些外部输入和长期资源,最后返回什么, "type_registry": 这个工序自己造的类型词(没有可不写),第二阶段归类时填, "steps": [ 一步步的操作 ], "return_row": 表格最后一行,写明最终交付什么(可不写) } ``` --- ## 第一阶段要填的字段 每个工序填:`id` / `name` / `purpose` / `category` / `platform` / `author` / `declarations` / `steps`。 ### 步骤级字段 | 字段 | 什么意思 | 怎么填 | 别这样 | | ----------- | ------------- | ---------------------------------------------------------------------------- | ------------------------- | | `id` | 第几步 | `s1`、`s2`;控制块子步用点号 `s6.1` | — | | `kind` | 步骤类型 | 普通步写 `step`;控制块用 `block` / `nested`(见下) | — | | `via` | 用了哪个具体工具/产品 | 写工具标准名:`manus`、`nano_banana_pro`、`human`(人工);原文没点名就括号占位 `(AI 生图工具)`;控制块写 `-` | 写一句话描述(那是 `directive` 的活) | | `directive` | 真正喂给工具的提示词/命令 | 把原文里的提示词原样引过来;"给工具的指示"(如"严格反推,别发挥"、"比例 2:3")也归这里;纯人工/控制块步留空 | 把画面内容描述写进来(那是输入的 `value`) | ### 输入 / 输出的字段 | 字段 | 什么意思 | 怎么填 | 别这样 | | ---------- | ------------------- | --------------------------------------------------------------------------- | ------------------------- | | `type` | 这份数据是什么角色(参考图?提示词?) | 从类型词表里挑;词表没有就自造,但要在工序 `type_registry` 里说明它"算作"哪个标准词 | 既不在词表、又没挂靠 | | `value` | 数据内容本身 | 文字类完整写出;图片/视频用尖括号写描述 `<一张床上女性的人像>` | 写"见上一步"这种引用;写"[图3显示]"这种说明 | | `anchor` | 来源 / 去处 | 输入写来源:`← 工序输入`、`← s2o1`、`← s2o1[i]`(循环逐个取);输出写去处:`→ s7`、`→ 某列表.追加`、`→ 返回 X` | 在这里描述内容(那是 `value` 的活) | | `id`(输出专属) | 输出的编号 | 工序内唯一,如 `s2o1`;只有一个输出时 `s2` 也行 | 重复编号 | > ⚠ **值一定要写真实内容**:哪怕某个输入就是上一步输出原样传过来的,"值"里也要把内容**完整抄一遍**,不能写"(同上)""见 s2o1"。嫌麻烦的话:只在源头填一次真内容,其余地方把"来源"写对,然后跑一次 `wf-patch.py --resolve-passthrough`,它会顺着编号自动把内容抄过去。 **输入不用编号**——没人会反过来引用一个输入。 ### 命名约定 - 类型名用**中文**;工具品牌名用**英文标准写法**(`seedream_4_5`,不要写成 `ByteDance-Seedream-4.5`)。 - 每个输出都要有编号(工序内不重复),供后续步骤按编号引用。 - 自造的类型要挂靠:在工序的 `type_registry` 里写明它"算作"哪个标准词 + 一句说明,例如 `"主角图": {"extends": "参考图", "desc": "本案例的女主肖像"}`。 --- ### 1.1 怎么判断"有几个工序" ⚠ 跟原文的章节标题无关:不管原文把某段叫"案例示范"还是"进阶玩法",只要满足下面三条,就算一条独立工序。**判断的单位是"一条完整的 输入→最终产物 链",不是原文的段落结构。** **怎么扫**:以原文里**每一张出现的成品图**(或明确写出的最终产物)为起点,逐个看它有没有对应的"输入→做法"链条。有就记为一个候选工序,再用下面三条筛。**别按段落扫。** 1. 有明确产物:这条链能产出一个看得见的结果(图、素材、成品)。 2. 有具体做法:链条里有可操作的方法(提示词、框架、流程)。 3. 产物或做法有差异:跟别的工序比,产物不同 **或** 做法不同,满足一条即可。哪怕产物类型一样(都是场景图),只要提示词不同,就算两个工序,**不能合并**。 边界判断: - 同一条链内部的中间步骤,归进这条工序,不单拆(比如做海报时先生成背景图,背景图是中间步骤,不是独立工序)。 - 只展示了成品、完全没讲输入和做法的,不算工序。 - 产物类似但做法不同 → 算两个工序。**不能**因为"产物类型相同""方法论相似"就合并。 ### 1.2 哪些"没写出来"的要主动补 真实教程经常会省略一些理所当然的中间产物。比如某步要"自己写动作序列",原文没提它得先有一张主角图当参考——但工艺上这张图必不可少。这种**该有却没写出来**的输入/输出,要主动补上并标注推断原因;某个字段实在判断不出就留空,**不要硬编一个假的**。 原文常省略的几类: - **工具常识**:生成模型一般要带模型/参数;召回要有检索依据;视频生成要有主角图/分镜图当参考。 - **前后对不上**:下游用到了 X 但上游没产出 X → 是不是漏抽了?某个输出后面没人用 → 是不是漏了使用它的步骤? - **工艺常识**:短剧 = 分镜图 → 视频片段 → 拼接;建素材库 = 收集 + 入库 + 建索引。 补出来的输入输出标上 `inferred: true` 和原因(让后面复核),别悄悄塞进去: ```json { "type": "参考图", "value": "<一张主角肖像>", "anchor": "← s2o1", "inferred": true, "inferred_reason": "原文只说'自己写动作',没提主角图;但写动作序列需要它当角色参考" } ``` - ✅ **该补**:工艺上必然需要的中间产物;原文用了复数("这些素材库")但只列了一个,把其余补全。 - ❌ **不用补**:归一化分类(那是第二阶段的常规活);只是把原文换个说法;原文细节确实没写全(那是信息缺失,不算"推断")。 - ⚠ 推断标记只能加在**步骤的输入/输出**上,不要加在工序的 `declarations` 上(那里只收 `type`/`name`/`desc` 三个字段)。 ### 1.2 有循环/并行/分支怎么切 原文里如果有"对每个 X 重复""同时做几个版本""分情况",切步骤时要展开成**控制块 + 子步**,别硬压成一个步骤: - **块本身**(`"kind": "block"`):`via` 写 `-`,块的输入输出表达"整个循环在做什么"。 - **块里的每一步**(`"kind": "nested"`,并写上 `"group": "块的编号"`):编号带点号(块是 `s5`,子步就是 `s5.1`),表达"每一次具体怎么做"。 ```json { "id":"s5", "kind":"block", "via":"-", "inputs": [{"type":"分镜脚本","value":"...","anchor":"← s4o1"}], "outputs":[{"id":"s5o1","type":"分镜图列表","value":"...","anchor":"→ s6"}] } { "id":"s5.1", "kind":"nested", "group":"s5", "via":"nano_banana", "directive":"按场景提示词生成,保持主角一致", "inputs": [{"type":"提示词","value":"...","anchor":"← s4o1[i]"}, {"type":"参考图","value":"...","anchor":"← s5o1[-1]"}], "outputs":[{"id":"s5.1o1","type":"分镜图","value":"...","anchor":"→ 分镜图列表.追加"}] } ``` - **循环里取数据**:来源写 `← s4o1[i]`(逐个取)、`← s5o1[-1]`(取上一次的产出,做"接力"参考)。 - **往列表里攒结果**:去处写 `→ 分镜图列表.追加`。 - **一步产出好几样东西**:就写好几个输出(每个都有自己的编号),别合并成一个。 - 抽样、重试这类小修饰,直接写进 `directive` 里说明即可。 ### 1.3 连数据流时自查这几条 - 每个输入的"来源"(`← 某编号`)都能找到已存在的输出编号,或是 `← 工序输入`、字面量。 - 输入的类型,和它"来源"指向的那个输出的类型一致。 - 循环索引用在合理位置(`[i]` 在循环里,`[-1]` 指最近一项)。 - 接力/链式引用关系正确。 ### 1.3 怎么批量连(重要) `workflow.json` 由你**直接演化,绝不写 Python 脚本去生成/批改它**(脚本拼 JSON 容易踩转义坑、把文件弄坏)。几十处"来源/去处"用 `wf-patch.py` 一次搞定: 1. 把要改的清单写到 `_scratch/anchors.json` —— `[{"path":"p1.s1.inputs[0].anchor","value":"← s0o1"}, ...]`,**每条都是你的判断**(连到哪个编号是语义决定,不是机械套用); 2. 跑 `python spec/tools/wf-patch.py --workflow workflow.json --patch _scratch/anchors.json`。 工具负责安全写 JSON + 检查格式(有一条不合法就整批不写),你从不直接碰 JSON 文本。零星单处改,用 Edit 就行。路径写法见 [tools.md](../tools.md)。 ### 1.3 内容自动抄写 "来源"连好后,跑一次 `python spec/tools/wf-patch.py --workflow workflow.json --resolve-passthrough`。对那些"原样接收上游输出"的输入(来源是 `← 某编号`),你**不用手抄上游内容**——只在源头那个输出里填一次真内容,工具会顺着编号把它逐字抄到所有引用处("值"先留空即可)。**别把"(同上)"这种引用当最终内容留着**(检查会报)。 ### 输出格式要求 复制下方模板改即可。 ```json { "source": { "platform": "<填:原文平台 e.g. wechat-gzh>", "author": "<填:原文作者>", "date": "<填:发布日期 e.g. 2026 上半年>", "url": "<填:原文 URL>", "title": "<填:原文标题>", "excerpt": "<填:摘要 1-3 句>" }, "procedures": [ { "id": "p1", "name": "<填:工序名 e.g. 产品场景图生成>", "purpose": "<填:一句话目的>", "category": "<填:产物创造|资产建设|自动化|分析|学习>", "platform": "<填:平台>", "author": "<填:作者>", "declarations": { "inputs": [{ "type": "<填:类型>", "name": "<填:声明名>", "desc": "<填:说明 (可选)>" }], "resources": [], "returns": { "type": "<填:返回类型>" } }, "steps": [ { "id": "s1", "kind": "step", "via": "<填:工具名 e.g. human / nano_banana / (AI 生图工具)>", "directive": "<填:给工具的 prompt 文本 (可选;人工/控制流步留空)>", "inputs": [ { "type": "<填:类型>", "value": "<填:数据内容本身>", "anchor": "<填:← 工序输入 / ← s1o1>" } ], "outputs": [ { "id": "s1o1", "type": "<填:类型>", "value": "<填:数据内容本身>", "anchor": "<填:→ s2 / → 返回 X>" } ] } ] } ] } ``` 有循环 / 并行 / 分支时,用控制块写法(无则不需要): ```json { "id": "s1", "kind": "block", "via": "-", "inputs": [{ "type": "<填:类型>", "value": "<填>", "anchor": "<填:← 上游 id>" }], "outputs": [{ "id": "s1o1", "type": "<填:类型>", "value": "<填:累积结果>", "anchor": "<填:→ sN>" }] }, { "id": "s1.1", "kind": "nested", "group": "s1", "via": "<填:工具名>", "directive": "<填:给工具的 prompt (可选)>", "inputs": [{ "type": "<填:类型>", "value": "<填>", "anchor": "<填:← 被遍历序列 id[i]>" }], "outputs": [{ "id": "s1.1o1", "type": "<填:类型>", "value": "<填:单次产出>", "anchor": "<填:→ 累积结果.追加>" }] } ```