split.txt 4.8 KB

1234567891011121314151617181920212223242526272829303132333435363738394041424344454647484950515253545556575859606162636465666768697071
  1. 你在做「创作知识拆分」:把多模态提取后的内容拆成一条或多条知识片段,每条标好 What / Why / How。不判断好坏(已筛选过),也不归类阶段/作用域(那是下一步)。
  2. <知识类型>
  3. - what(是什么 / 有哪些):类型、分类、构成要素、清单、特征、模板。
  4. - why(为什么 / 凭什么有效):原理、底层逻辑、机制、依据、原因。
  5. - how(怎么做 / 怎么用):方法、步骤、技巧、流程、公式框架。
  6. 对照:"脚本含 10 个要素" = what;"逐个把这 10 个要素填好" = how;"要素齐全能让观众一眼看懂故事" = why。
  7. </知识类型>
  8. <拆分规则>
  9. - 一条片段 = 一个知识对象:同一个知识对象的 what/why/how 放进同一条;多个相互独立的知识对象拆成多条。
  10. 为什么:知识库里一条记录应是一个能独立复用的知识单元——合并无关知识会让它无法被精准检索,过度拆分会把一个完整方法打碎。
  11. - 构成要素 / 清单 / 步骤属于同一个知识对象:一份"要素清单"或"一套步骤"整体作为**一条**(what=清单本身,how=怎么用这套清单),即使每个要素都各配了说明,也**不要每个要素各拆一条**。
  12. 判断标准:这些点是不是在共同支撑同一个方法/框架?是 → 合并成一条;只有当它们是彼此独立、能各自单独使用的方法时,才拆成多条。
  13. - 忠实:原文有什么提什么,没有的字段填 null,不为凑齐 what/why/how 而编。
  14. - knowledge_types 与非空字段一致(顺序 what→why→how)。
  15. - title 用能概括这条知识的具体短语,别用泛词("技巧""干货")。
  16. - 溯源:提取内容按【卡片N】分块(【综合】块来自正文/汇总)。每条知识填 source_cards=它出自哪些卡片号(可多张;纯来自【综合】/正文则填 [])。
  17. - evidence:先摘出支持这条知识的原句放进 evidence,每条写成 {{"text": "原句", "card": 出自的卡片号或 null}};先摘引、再判断,证据必须来自素材。
  18. </拆分规则>
  19. <示例>
  20. <example> 清单型:每个要素一张卡,仍合并为 1 条;source_cards 列全部相关卡
  21. 提取内容:【综合】短视频脚本含 10 个要素。【卡片1】标题:视频灵魂,精准点题。【卡片2】拍摄地点:给故事搭舞台。【卡片3】分镜:规划镜头顺序……(每张卡讲一个要素)
  22. 输出:{{"items": [
  23. {{"title": "短视频脚本的 10 个核心要素",
  24. "knowledge_types": ["what", "how"],
  25. "what": "短视频脚本由标题、拍摄地点、分镜……等 10 个要素构成",
  26. "why": null,
  27. "how": "按这份清单逐一规划每个要素,把脚本搭完整",
  28. "source_cards": [1, 2, 3],
  29. "evidence": [{{"text": "标题:视频灵魂,精准点题", "card": 1}}, {{"text": "拍摄地点:给故事搭舞台", "card": 2}}]}}
  30. ]}}
  31. (10 个要素共同支撑"脚本结构"一个方法 → 合并 1 条;source_cards 列出所有相关卡片。)
  32. </example>
  33. <example> 多个独立知识对象 → 多条片段
  34. 提取内容:【卡片1】爆款选题要撕裂大众共识,越让你写完感到羞耻越能引发转发。【卡片2】起号初期要垂直,连续发同一垂类系统才能给账号打标签。
  35. 输出:{{"items": [
  36. {{"title": "羞耻感选题法", "knowledge_types": ["why"], "what": null,
  37. "why": "撕裂大众共识、让你写完感到羞耻的选题更能激发转发", "how": null,
  38. "source_cards": [1], "evidence": [{{"text": "越让你写完感到羞耻越能引发转发", "card": 1}}]}},
  39. {{"title": "起号初期垂直打标签", "knowledge_types": ["why", "how"], "what": null,
  40. "why": "连续发同一垂类系统才能打标签", "how": "起号初期持续发同一垂直领域内容",
  41. "source_cards": [2], "evidence": [{{"text": "连续发同一垂类才能让系统打标签", "card": 2}}]}}
  42. ]}}
  43. </example>
  44. </示例>
  45. <不应做>
  46. - 把作品本身当知识(把一条具体文案原样塞进 how)。
  47. - 把帖子主题复述成知识(how 写成"讲了短视频脚本")。
  48. - 为结构完整编造 why。
  49. - 过度合并("叙事结构"+"运镜技巧"合一条)。
  50. - 过度拆分:把一份要素清单按要素拆成多条(如把"脚本 10 要素"拆成 10 条),或把一个方法的步骤各拆一条。
  51. </不应做>
  52. <输入>
  53. 帖子标题:{title}
  54. 话题:{topics}
  55. 多模态提取内容:
  56. {content}
  57. </输入>
  58. <输出>
  59. 只输出一个 JSON 对象:
  60. {{"items": [{{"title": "...", "knowledge_types": ["what/why/how"], "what": "...或null", "why": "...或null", "how": "...或null", "source_cards": [卡片号...], "evidence": [{{"text": "原句", "card": 卡片号或null}}]}}]}}
  61. </输出>
  62. <自查>
  63. 输出前核对:每条 knowledge_types 是否与非空 what/why/how 一致?有没有编造内容?每条是否是一个独立、可复用的知识对象?
  64. </自查>