Procházet zdrojové kódy

下掉视频理解

xueyiming před 4 dny
rodič
revize
eff5a4c94e

+ 0 - 2
agents/find_agent/agent.py

@@ -24,7 +24,6 @@ _EVIDENCE_TOOLS = {
     "get_account_fans_portrait",
     "batch_fetch_portraits",
     "normalize_age_portraits",
-    "qwen_video_analyze",
 }
 _VIDEO_ID_PATTERN = re.compile(r"(?<!\d)\d{15,22}(?!\d)")
 
@@ -263,7 +262,6 @@ def create_find_agent(
                 },
                 3,
             ),
-            "video_analysis": ({"qwen_video_analyze"}, 3),
             "evaluation_save": (
                 {"batch_save_video_candidate_evaluations"},
                 6,

+ 7 - 8
agents/find_agent/prompt/system_prompt.md

@@ -51,7 +51,7 @@
 搜索是一个可生长的探索图,而不是一次调用:
 
 - 根节点来自需求语义、参考视频标题和相关点揭示的不同内容假设;
-- 优质候选的 `topic_list`、话题标签、标题实体和视频分析中出现的新角度,可以成为
+- 优质候选的 `topic_list`、话题标签、标题实体和详情字段中出现的新角度,可以成为
   子节点;只有与本次目标内容相关或可能产生高价值补充候选的标签才允许扩展;
 - `has_more=true` 与 `next_cursor` 表示同一关键词仍有搜索前沿,翻页不是重复搜索;
 - 每个新词和每一页都必须记录来源,使最终能够解释“为什么搜这个词”。
@@ -132,7 +132,7 @@
 
 ## 10. 信息价值停止律
 
-只有当一次额外搜索、详情、画像或视频解析有可能改变准入、排序或置信度时,它才有价值。证据已经足够区分候选时停止;证据不足以支持任何候选时返回“暂无可靠推荐”,不得为了凑数放宽公理。
+只有当一次额外搜索、详情或画像有可能改变准入、排序或置信度时,它才有价值。证据已经足够区分候选时停止;证据不足以支持任何候选时返回“暂无可靠推荐”,不得为了凑数放宽公理。
 
 # 工具的证据含义
 
@@ -144,7 +144,7 @@
 - `douyin_user_videos`:当候选作者的粉丝画像偏老、或其视频具有较高主推荐/补充
   潜力时,按最热或最新扩展作者作品。作者作品属于 `author` 搜索分支,仍需逐条判断
   相关性、老年倾向和分享价值,不能因作者优秀就直接推荐。
-- `douyin_detail`:用于核验候选的最新互动数据、作者、页面链接和可分析的视频地址
+- `douyin_detail`:用于核验候选的最新互动数据、作者、页面链接和标题/描述等文本证据
 - `batch_fetch_portraits`:用于批量取得视频点赞画像;对正式候选应设置
   `fetch_account_portrait=true`,同时取得作者粉丝画像。批量结果会自动附带
   `age_normalization`,无需为同一候选再单独调用标准化工具。
@@ -153,7 +153,6 @@
   等年龄桶统一为直接老年比例、TGI、成熟代理比例和证据强度;取得画像后必须调用,
   不得自行猜测 `50-` 的含义。使用 `batch_fetch_portraits` 时已经自动执行同一标准化,
   不要重复调用。
-- `qwen_video_analyze`:用于核验高潜候选的真实内容、相关性和分享动机。它不能代替年龄画像。解析提示中必须包含本次 `demand_word` 和 `relevant_points`,并要求区分“视频明确呈现”与“模型推断”。
 - `create_video_discovery_run`:在开始探索时保存输入并取得 `run_id`。若用户消息已给出
   预创建 `run_id`,必须原样传入该 `run_id` 复用已有记录,禁止自行生成新的 `run_id`。
 - `record_video_search_page`:每次 `douyin_search` 后保存实际搜索词、形成原因、标签或
@@ -166,7 +165,7 @@
 - `query_video_discovery_state`:恢复长搜索的已探索关键词、翻页状态和候选分池,也用于
   查看已经保存的模型决定。
 
-优先让廉价证据淘汰没有主推荐价值、也没有补充潜力的候选。详情、双画像和视频解析
+优先让廉价证据淘汰没有主推荐价值、也没有补充潜力的候选。详情与双画像
 用于仍可能进入主推荐或补充候选的候选。所有工具失败都保留原始错误语义,不得编造
 缺失字段。
 
@@ -181,9 +180,9 @@
   提升主推荐或补充候选质量;
 - 搜索结果先按需求相关性、分享规模/效率和备选潜力做廉价预筛,默认最多选择8条进入
   `douyin_detail` 和双画像阶段;
-- 默认最多选择3条最可能改变主推荐或补充候选的候选调用 `qwen_video_analyze`;
-  只有确实需要补充内容证据时才增加
-- 执行新搜索、翻页、详情、画像或视频解析后,应重新保存受影响候选;
+- 内容相关性与分享动机主要依据标题、描述、`topic_list`、话题标签和详情字段判断,
+  不得依赖视频画面解析
+- 执行新搜索、翻页、详情或画像后,应重新保存受影响候选;
 - 不得用“接下来我会继续”作为最终回答。当前不依赖运行时完成守卫,Agent 必须自行
   决定何时结束。
 - 数据库保留数量达到 5 条后,若没有明显更高价值的搜索前沿,优先结束任务。

+ 0 - 3
agents/find_agent/tools/__init__.py

@@ -20,7 +20,6 @@ from agents.find_agent.tools.hotspot_profile import (
     get_account_fans_portrait,
     get_content_fans_portrait,
 )
-from agents.find_agent.tools.qwen_video_analyze import qwen_video_analyze
 from agents.find_agent.tools.video_discovery_store import (
     batch_save_video_candidate_evaluations,
     create_video_discovery_run,
@@ -38,7 +37,6 @@ ALL_TOOLS: list[Callable[..., Any]] = [
     get_account_fans_portrait,
     batch_fetch_portraits,
     normalize_age_portraits,
-    qwen_video_analyze,
     create_video_discovery_run,
     record_video_search_page,
     batch_save_video_candidate_evaluations,
@@ -55,7 +53,6 @@ __all__ = [
     "get_account_fans_portrait",
     "batch_fetch_portraits",
     "normalize_age_portraits",
-    "qwen_video_analyze",
     "create_video_discovery_run",
     "record_video_search_page",
     "batch_save_video_candidate_evaluations",