visualize.py 27 KB

123456789101112131415161718192021222324252627282930313233343536373839404142434445464748495051525354555657585960616263646566676869707172737475767778798081828384858687888990919293949596979899100101102103104105106107108109110111112113114115116117118119120121122123124125126127128129130131132133134135136137138139140141142143144145146147148149150151152153154155156157158159160161162163164165166167168169170171172173174175176177178179180181182183184185186187188189190191192193194195196197198199200201202203204205206207208209210211212213214215216217218219220221222223224225226227228229230231232233234235236237238239240241242243244245246247248249250251252253254255256257258259260261262263264265266267268269270271272273274275276277278279280281282283284285286287288289290291292293294295296297298299300301302303304305306307308309310311312313314315316317318319320321322323324325326327328329330331332333334335336337338339340341342343344345346347348349350351352353354355356357358359360361362363364365366367368369370371372373374375376377378379380381382383384385386387388389390391392393394395396397398399400401402403404405406407408409410411412413414415416417418419420421422423424425426427428429430431432433434435436437438439440441442443444445446447448449450451452453454455456457458459460461462463464465466467468469470471472473474475476477478479480481482483484485486487488489490491492493494495496497498499500501502503504505506507508509510511512513514515516517518519520521522523524525526527528529530531532533534535536537538539540541542543544545546547548549550551552553554555556557558559560561562563564565566567568569570571572573574575576577578579580581582583584585586587588589590591592593594595596597598599600601602603604605606607608609610611612613614615616617618619620621622623624625626627628629630631632633634635636637638639640641642643644645646647648649650651652653654655656657658659660661662663664665666667668669670671672673674675676677678679680681682683684685686687688689690691692693694695696697698699700701702703704705706707708709710711712713714715716717718719720721722723724725726727728729730731732733734735736737738739740741742743744745746747748749750751752753754755756757758759760761762763764765766767768769770771772773774775776777778779780781782783784785786787788789790791792793794795796797798799800801802803804805806807808809810811812813814815816817818819820821822823824825826827828829830831832833834835836837838839840841842843844845846847848849850851852853854855856857858859860861862863864865866867868869870871872873874875876877878879880881882883884885886887888889890891892893894895896897898899900901902903904905906907908
  1. """Generate a standalone HTML visualization for an agent run."""
  2. from __future__ import annotations
  3. import html
  4. import json
  5. from pathlib import Path
  6. from typing import Any
  7. import markdown as _markdown_lib
  8. from supply_agent.logging.parser import load_run_events, summarize_run
  9. _MARKDOWN_EXTENSIONS = ["fenced_code", "tables", "sane_lists"]
  10. def _render_markdown(text: Any, *, soft_breaks: bool = False, boxed: bool = True) -> str:
  11. """Render text as Markdown; ``boxed`` wraps it in a bordered, scrollable box."""
  12. if not text:
  13. return ""
  14. extensions = [*_MARKDOWN_EXTENSIONS, "nl2br"] if soft_breaks else _MARKDOWN_EXTENSIONS
  15. body = _markdown_lib.markdown(str(text), extensions=extensions)
  16. if not boxed:
  17. return f'<div class="markdown-body">{body}</div>'
  18. return f'<div class="markdown-box"><div class="markdown-body">{body}</div></div>'
  19. def _esc(text: Any) -> str:
  20. if text is None:
  21. return ""
  22. return html.escape(str(text))
  23. def _pretty(obj: Any) -> str:
  24. if obj is None:
  25. return ""
  26. if isinstance(obj, str):
  27. try:
  28. obj = json.loads(obj)
  29. except (json.JSONDecodeError, TypeError):
  30. return obj
  31. return json.dumps(obj, ensure_ascii=False, indent=2)
  32. def _pre(text: Any, *, klass: str = "code") -> str:
  33. if text is None:
  34. content = ""
  35. else:
  36. content = _pretty(text)
  37. return f'<pre class="{klass}">{_esc(content)}</pre>'
  38. def _message_fingerprint(msg: dict[str, Any]) -> str:
  39. return json.dumps(msg, ensure_ascii=False, sort_keys=True, default=str)
  40. def _common_prefix_len(a: list[dict[str, Any]], b: list[dict[str, Any]]) -> int:
  41. n = 0
  42. for left, right in zip(a, b):
  43. if _message_fingerprint(left) != _message_fingerprint(right):
  44. break
  45. n += 1
  46. return n
  47. def _split_history_and_latest(
  48. messages: list[dict[str, Any]],
  49. prev_messages: list[dict[str, Any]] | None,
  50. ) -> tuple[list[dict[str, Any]], list[dict[str, Any]]]:
  51. """
  52. Split request messages into (history, latest).
  53. ``latest`` is only what is newly added since the previous LLM input;
  54. ``history`` is everything else (hidden by default in the UI).
  55. """
  56. if not messages:
  57. return [], []
  58. if not prev_messages:
  59. if len(messages) > 1 and messages[0].get("role") == "system":
  60. return messages[:1], messages[1:]
  61. return [], list(messages)
  62. curr_has_sys = messages[0].get("role") == "system"
  63. prev_has_sys = prev_messages[0].get("role") == "system"
  64. curr_sys = messages[0] if curr_has_sys else None
  65. prev_sys = prev_messages[0] if prev_has_sys else None
  66. curr_rest = messages[1:] if curr_has_sys else messages
  67. prev_rest = prev_messages[1:] if prev_has_sys else prev_messages
  68. k = _common_prefix_len(curr_rest, prev_rest)
  69. history_rest = curr_rest[:k]
  70. latest = list(curr_rest[k:])
  71. history: list[dict[str, Any]] = []
  72. if curr_sys is not None:
  73. history.append(curr_sys)
  74. history.extend(history_rest)
  75. # Surface an updated system prompt in the latest section
  76. if (
  77. curr_sys is not None
  78. and prev_sys is not None
  79. and _message_fingerprint(curr_sys) != _message_fingerprint(prev_sys)
  80. ):
  81. latest = [curr_sys, *latest]
  82. history = list(history_rest)
  83. if not latest:
  84. return messages[:-1], messages[-1:]
  85. return history, latest
  86. def _role_badge(role: str) -> str:
  87. return f'<span class="badge role-{_esc(role)}">{_esc(role)}</span>'
  88. def _render_messages(
  89. messages: list[dict[str, Any]] | None,
  90. *,
  91. default_open: bool | None = None,
  92. ) -> str:
  93. if not messages:
  94. return '<p class="muted">无消息</p>'
  95. parts: list[str] = []
  96. for msg in messages:
  97. role = msg.get("role", "?")
  98. body_parts: list[str] = []
  99. if msg.get("content"):
  100. body_parts.append(_pre(msg["content"], klass="code prose"))
  101. if role in ("user", "tool"):
  102. open_attr = ""
  103. elif default_open is None:
  104. open_attr = "open" if role != "system" else ""
  105. else:
  106. open_attr = "open" if default_open else ""
  107. if role == "tool":
  108. tool_name = msg.get("name") or "?"
  109. summary_html = (
  110. f'{_role_badge(role)} <span class="msg-preview">{_esc(tool_name)}</span>'
  111. )
  112. else:
  113. preview = _preview(msg.get("content"))
  114. if not preview and msg.get("tool_calls"):
  115. names = []
  116. for tc in msg["tool_calls"]:
  117. name, _, _ = _normalize_tool_call(tc)
  118. names.append(name)
  119. preview = "调用: " + ", ".join(names)
  120. summary_html = (
  121. f'{_role_badge(role)} <span class="msg-preview">{_esc(preview)}</span>'
  122. )
  123. parts.append(
  124. f"""
  125. <details class="msg" {open_attr}>
  126. <summary>{summary_html}</summary>
  127. <div class="msg-body">{"".join(body_parts)}</div>
  128. </details>
  129. """
  130. )
  131. return '<div class="msg-list">' + "".join(parts) + "</div>"
  132. def _preview(text: Any, limit: int = 80) -> str:
  133. if not text:
  134. return ""
  135. s = " ".join(str(text).split())
  136. return s if len(s) <= limit else s[: limit - 1] + "…"
  137. def _tool_names(tools: list[dict[str, Any]] | None) -> list[str]:
  138. if not tools:
  139. return []
  140. names: list[str] = []
  141. for t in tools:
  142. fn = t.get("function") or t
  143. names.append(fn.get("name", "?"))
  144. return names
  145. def _extract_system_prompt_and_tools(
  146. events: list[dict[str, Any]],
  147. ) -> tuple[str | None, list[str]]:
  148. """Pull the system prompt and tool list from the first llm_input event."""
  149. for ev in events:
  150. if ev.get("event") != "llm_input":
  151. continue
  152. data = ev.get("data") or {}
  153. messages = data.get("messages") or []
  154. sys_msg = next((m for m in messages if m.get("role") == "system"), None)
  155. content = sys_msg.get("content") if sys_msg else None
  156. return content, _tool_names(data.get("tools"))
  157. return None, []
  158. def _render_llm_input_section(
  159. data: dict[str, Any],
  160. *,
  161. prev_messages: list[dict[str, Any]] | None = None,
  162. ) -> tuple[str, list[dict[str, Any]]]:
  163. """Render the LLM-input body; returns (html, messages) so callers can track history."""
  164. messages = list(data.get("messages") or [])
  165. _history, latest = _split_history_and_latest(messages, prev_messages)
  166. latest_count = len(latest)
  167. html_out = f"""
  168. <section class="substep">
  169. <div class="substep-header">
  170. <span class="substep-title">LLM 输入</span>
  171. <span class="tag">新增 {latest_count}</span>
  172. </div>
  173. <div class="substep-body">
  174. {_render_messages(latest, default_open=True)}
  175. </div>
  176. </section>
  177. """
  178. return html_out, messages
  179. def _render_reasoning(reasoning: Any) -> str:
  180. if not reasoning:
  181. return ""
  182. return f"""
  183. <div class="reasoning">
  184. <div class="sublabel">思考过程</div>
  185. {_render_markdown(reasoning, soft_breaks=True, boxed=False)}
  186. </div>
  187. """
  188. def _parse_tool_arguments(arguments: Any) -> Any:
  189. if isinstance(arguments, str):
  190. try:
  191. return json.loads(arguments)
  192. except (json.JSONDecodeError, TypeError):
  193. return arguments
  194. return arguments
  195. def _normalize_tool_call(tc: dict[str, Any]) -> tuple[str, Any, str]:
  196. """Return (name, parsed_args, id) from flat or OpenAI function-wrapped tool_call."""
  197. name = tc.get("name") or (tc.get("function") or {}).get("name") or "?"
  198. raw_args = tc.get("arguments")
  199. if raw_args is None and isinstance(tc.get("function"), dict):
  200. raw_args = tc["function"].get("arguments")
  201. return name, _parse_tool_arguments(raw_args), str(tc.get("id") or "")
  202. def _render_output_tool_calls(tool_calls: list[dict[str, Any]]) -> str:
  203. """Show each tool the model decided to call, collapsed by default; expand for args."""
  204. if not tool_calls:
  205. return ""
  206. parts: list[str] = []
  207. for tc in tool_calls:
  208. name, args, _ = _normalize_tool_call(tc)
  209. parts.append(
  210. f"""
  211. <details class="msg">
  212. <summary><span class="badge role-tool">tool</span> <span class="msg-preview">{_esc(name)}</span></summary>
  213. <div class="msg-body">{_pre(args)}</div>
  214. </details>
  215. """
  216. )
  217. return '<div class="msg-list">' + "".join(parts) + "</div>"
  218. def _render_llm_output_section(data: dict[str, Any]) -> str:
  219. tool_calls = data.get("tool_calls") or []
  220. reasoning = data.get("reasoning")
  221. content = data.get("content")
  222. usage = data.get("usage")
  223. usage_html = ""
  224. if usage:
  225. usage_html = f"""
  226. <div class="usage">
  227. <span>prompt: {_esc(usage.get("prompt_tokens", "—"))}</span>
  228. <span>completion: {_esc(usage.get("completion_tokens", "—"))}</span>
  229. <span>total: {_esc(usage.get("total_tokens", "—"))}</span>
  230. <span>cost: {_esc(usage.get("cost", "—"))}</span>
  231. </div>
  232. """
  233. content_html = (
  234. f"<h4>模型输出文本</h4>{_render_markdown(content, soft_breaks=True)}"
  235. if content
  236. else ""
  237. )
  238. tags: list[str] = []
  239. if reasoning:
  240. tags.append('<span class="tag">有思考</span>')
  241. if tool_calls:
  242. tags.append(f'<span class="tag">{len(tool_calls)} tool calls</span>')
  243. return f"""
  244. <section class="substep">
  245. <div class="substep-header">
  246. <span class="substep-title">LLM 输出</span>
  247. {"".join(tags)}
  248. </div>
  249. <div class="substep-body">
  250. {_render_reasoning(reasoning)}
  251. {content_html}
  252. {_render_output_tool_calls(tool_calls)}
  253. {usage_html}
  254. </div>
  255. </section>
  256. """
  257. def _render_step_card(
  258. step_no: int,
  259. iteration: Any,
  260. title: str,
  261. inner_html: str,
  262. ) -> str:
  263. return f"""
  264. <article class="card card-step" id="step-{step_no}">
  265. <header class="card-header">
  266. <div class="step-num">Step {step_no}</div>
  267. <div class="card-title">{title}</div>
  268. <div class="card-tags">
  269. <span class="tag">iteration {iteration}</span>
  270. </div>
  271. </header>
  272. <div class="card-body step-body">
  273. {inner_html}
  274. </div>
  275. </article>
  276. """
  277. def _render_skill(data: dict[str, Any], step_no: int, iteration: Any) -> str:
  278. return f"""
  279. <article class="card card-skill" id="step-{step_no}">
  280. <header class="card-header">
  281. <div class="step-num">Step {step_no}</div>
  282. <div class="card-title">技能加载</div>
  283. <div class="card-tags">
  284. <span class="tag">iteration {iteration}</span>
  285. <span class="tag">{_esc(data.get("skill", ""))}</span>
  286. </div>
  287. </header>
  288. </article>
  289. """
  290. _HIDDEN_EVENT_TYPES = ("run_start", "run_end", "tool_call")
  291. def _group_visible_events(
  292. events: list[dict[str, Any]],
  293. ) -> list[list[dict[str, Any]]]:
  294. """
  295. Group renderable events into steps.
  296. A consecutive ``llm_input`` immediately followed by ``llm_output`` forms a
  297. single step (one round-trip); everything else is its own step.
  298. """
  299. visible = [ev for ev in events if ev.get("event") not in _HIDDEN_EVENT_TYPES]
  300. groups: list[list[dict[str, Any]]] = []
  301. i = 0
  302. n = len(visible)
  303. while i < n:
  304. ev = visible[i]
  305. if (
  306. ev.get("event") == "llm_input"
  307. and i + 1 < n
  308. and visible[i + 1].get("event") == "llm_output"
  309. ):
  310. groups.append([ev, visible[i + 1]])
  311. i += 2
  312. else:
  313. groups.append([ev])
  314. i += 1
  315. return groups
  316. def _event_iteration(ev: dict[str, Any]) -> Any:
  317. data = ev.get("data") or {}
  318. return ev.get("iteration", data.get("iteration", "—"))
  319. def _render_timeline(events: list[dict[str, Any]]) -> str:
  320. parts: list[str] = []
  321. prev_llm_messages: list[dict[str, Any]] | None = None
  322. for step_no, group in enumerate(_group_visible_events(events), start=1):
  323. if len(group) == 2:
  324. input_ev, output_ev = group
  325. input_data = input_ev.get("data") or {}
  326. output_data = output_ev.get("data") or {}
  327. input_html, messages = _render_llm_input_section(
  328. input_data, prev_messages=prev_llm_messages
  329. )
  330. prev_llm_messages = messages
  331. output_html = _render_llm_output_section(output_data)
  332. parts.append(
  333. _render_step_card(
  334. step_no,
  335. _event_iteration(input_ev),
  336. "LLM 输入 · 输出",
  337. input_html + output_html,
  338. )
  339. )
  340. continue
  341. ev = group[0]
  342. etype = ev.get("event")
  343. data = ev.get("data") or {}
  344. iteration = _event_iteration(ev)
  345. if etype == "llm_input":
  346. input_html, messages = _render_llm_input_section(
  347. data, prev_messages=prev_llm_messages
  348. )
  349. prev_llm_messages = messages
  350. parts.append(_render_step_card(step_no, iteration, "LLM 输入", input_html))
  351. elif etype == "llm_output":
  352. output_html = _render_llm_output_section(data)
  353. parts.append(_render_step_card(step_no, iteration, "LLM 输出", output_html))
  354. elif etype == "skill_loaded":
  355. parts.append(_render_skill(data, step_no, iteration))
  356. else:
  357. parts.append(
  358. f"""
  359. <article class="card" id="step-{step_no}">
  360. <header class="card-header">
  361. <div class="step-num">Step {step_no}</div>
  362. <div class="card-title">{_esc(etype)}</div>
  363. </header>
  364. <div class="card-body">{_pre(data)}</div>
  365. </article>
  366. """
  367. )
  368. return "\n".join(parts)
  369. def _nav_items(events: list[dict[str, Any]]) -> str:
  370. items: list[str] = []
  371. labels = {
  372. "llm_input": "LLM 输入",
  373. "llm_output": "LLM 输出",
  374. "skill_loaded": "技能",
  375. }
  376. for step_no, group in enumerate(_group_visible_events(events), start=1):
  377. if len(group) == 2:
  378. ev = group[0]
  379. label = "LLM 输入 · 输出"
  380. nav_class = "nav-step-pair"
  381. detail = f" · iter {_event_iteration(ev)}"
  382. else:
  383. ev = group[0]
  384. etype = ev.get("event")
  385. label = labels.get(etype, etype or "?")
  386. nav_class = f"nav-{_esc(etype or '')}"
  387. detail = ""
  388. if etype in ("llm_input", "llm_output"):
  389. detail = f" · iter {_event_iteration(ev)}"
  390. items.append(
  391. f'<a class="nav-item {nav_class}" href="#step-{step_no}">'
  392. f'<span class="nav-seq">{step_no}</span>{label}{detail}</a>'
  393. )
  394. return "\n".join(items)
  395. _CSS = """
  396. :root {
  397. --bg: #f4f6f9;
  398. --bg-elev: #ffffff;
  399. --bg-card: #ffffff;
  400. --border: #d8dee8;
  401. --text: #1a2332;
  402. --muted: #6b7c93;
  403. --accent: #2563eb;
  404. --input: #2563eb;
  405. --output: #059669;
  406. --skill: #7c3aed;
  407. --code-bg: #f8fafc;
  408. --mono: "JetBrains Mono", "SF Mono", "Fira Code", ui-monospace, monospace;
  409. --sans: "IBM Plex Sans", "Segoe UI", system-ui, sans-serif;
  410. }
  411. * { box-sizing: border-box; }
  412. html { scroll-behavior: smooth; }
  413. body {
  414. margin: 0;
  415. font-family: var(--sans);
  416. background: var(--bg);
  417. color: var(--text);
  418. line-height: 1.55;
  419. }
  420. a { color: var(--accent); text-decoration: none; }
  421. a:hover { text-decoration: underline; }
  422. .layout {
  423. display: grid;
  424. grid-template-columns: 260px 1fr;
  425. min-height: 100vh;
  426. }
  427. .sidebar {
  428. position: sticky;
  429. top: 0;
  430. height: 100vh;
  431. overflow: auto;
  432. background: var(--bg-elev);
  433. border-right: 1px solid var(--border);
  434. padding: 1.25rem 1rem;
  435. box-shadow: 1px 0 0 rgba(26, 35, 50, 0.02);
  436. }
  437. .sidebar h1 {
  438. font-size: 0.95rem;
  439. margin: 0 0 0.25rem;
  440. letter-spacing: 0.02em;
  441. color: var(--text);
  442. }
  443. .sidebar .run-id {
  444. font-family: var(--mono);
  445. font-size: 0.7rem;
  446. color: var(--muted);
  447. word-break: break-all;
  448. margin-bottom: 1rem;
  449. }
  450. .nav-item {
  451. display: flex;
  452. align-items: center;
  453. gap: 0.5rem;
  454. padding: 0.4rem 0.55rem;
  455. border-radius: 6px;
  456. color: var(--text);
  457. font-size: 0.8rem;
  458. margin-bottom: 2px;
  459. }
  460. .nav-item:hover { background: #eef2f7; text-decoration: none; }
  461. .nav-seq {
  462. font-family: var(--mono);
  463. font-size: 0.7rem;
  464. color: var(--muted);
  465. min-width: 1.4rem;
  466. }
  467. .nav-llm_input { border-left: 3px solid var(--input); }
  468. .nav-llm_output { border-left: 3px solid var(--output); }
  469. .nav-step-pair { border-left: 3px solid var(--input); }
  470. .nav-skill_loaded { border-left: 3px solid var(--skill); }
  471. .main { padding: 1.5rem 2rem 3rem; max-width: 1100px; }
  472. .hero {
  473. background: linear-gradient(145deg, #ffffff 0%, #f0f5ff 55%, #f3faf6 100%);
  474. border: 1px solid var(--border);
  475. border-radius: 12px;
  476. padding: 1.5rem;
  477. margin-bottom: 1.5rem;
  478. box-shadow: 0 1px 2px rgba(26, 35, 50, 0.04);
  479. }
  480. .hero h2 { margin: 0 0 0.75rem; font-size: 1.35rem; }
  481. .stats {
  482. display: flex;
  483. flex-wrap: wrap;
  484. gap: 0.75rem;
  485. margin: 1rem 0;
  486. }
  487. .stat {
  488. background: #ffffff;
  489. border: 1px solid var(--border);
  490. border-radius: 8px;
  491. padding: 0.55rem 0.85rem;
  492. min-width: 110px;
  493. box-shadow: 0 1px 1px rgba(26, 35, 50, 0.03);
  494. }
  495. .stat .label { font-size: 0.7rem; color: var(--muted); text-transform: uppercase; letter-spacing: 0.04em; }
  496. .stat .value { font-family: var(--mono); font-size: 1rem; margin-top: 0.15rem; }
  497. .user-prompt {
  498. background: #eff6ff;
  499. border: 1px solid #bfdbfe;
  500. border-radius: 8px;
  501. padding: 0.85rem 1rem;
  502. white-space: pre-wrap;
  503. }
  504. .final {
  505. margin-top: 1rem;
  506. background: #ecfdf5;
  507. border: 1px solid #a7f3d0;
  508. border-radius: 8px;
  509. padding: 0.85rem 1rem;
  510. }
  511. .final h3 { margin: 0 0 0.5rem; font-size: 0.85rem; color: var(--output); }
  512. .timeline { display: flex; flex-direction: column; gap: 1rem; }
  513. .card {
  514. background: var(--bg-card);
  515. border: 1px solid var(--border);
  516. border-radius: 10px;
  517. overflow: hidden;
  518. box-shadow: 0 1px 2px rgba(26, 35, 50, 0.04);
  519. }
  520. .card-step { border-top: 3px solid var(--input); }
  521. .card-skill { border-top: 3px solid var(--skill); }
  522. .card-header {
  523. display: flex;
  524. flex-wrap: wrap;
  525. align-items: center;
  526. gap: 0.6rem;
  527. padding: 0.75rem 1rem;
  528. background: #f8fafc;
  529. border-bottom: 1px solid var(--border);
  530. }
  531. .step-num {
  532. font-family: var(--mono);
  533. font-size: 0.75rem;
  534. color: var(--muted);
  535. background: #eef2f7;
  536. padding: 0.15rem 0.45rem;
  537. border-radius: 4px;
  538. }
  539. .card-title { font-weight: 600; font-size: 0.95rem; }
  540. .card-tags { display: flex; flex-wrap: wrap; gap: 0.35rem; margin-left: auto; }
  541. .tag {
  542. font-size: 0.7rem;
  543. font-family: var(--mono);
  544. background: #ffffff;
  545. border: 1px solid var(--border);
  546. border-radius: 999px;
  547. padding: 0.12rem 0.5rem;
  548. color: var(--muted);
  549. }
  550. .card-body { padding: 1rem; }
  551. .card-body h4 {
  552. margin: 1rem 0 0.5rem;
  553. font-size: 0.8rem;
  554. color: var(--muted);
  555. text-transform: uppercase;
  556. letter-spacing: 0.05em;
  557. }
  558. .card-body h4:first-child { margin-top: 0; }
  559. .card-body.step-body { padding: 0; }
  560. .substep { padding: 1rem; }
  561. .substep + .substep { border-top: 1px solid var(--border); }
  562. .substep-header {
  563. display: flex;
  564. flex-wrap: wrap;
  565. align-items: center;
  566. gap: 0.5rem;
  567. margin-bottom: 0.65rem;
  568. }
  569. .substep-title {
  570. font-weight: 600;
  571. font-size: 0.8rem;
  572. color: var(--muted);
  573. text-transform: uppercase;
  574. letter-spacing: 0.05em;
  575. }
  576. .sublabel {
  577. font-size: 0.72rem;
  578. color: var(--muted);
  579. text-transform: uppercase;
  580. letter-spacing: 0.05em;
  581. margin-bottom: 0.35rem;
  582. }
  583. .muted { color: var(--muted); font-size: 0.85rem; }
  584. .code {
  585. font-family: var(--mono);
  586. font-size: 0.78rem;
  587. background: var(--code-bg);
  588. border: 1px solid var(--border);
  589. border-radius: 6px;
  590. padding: 0.75rem;
  591. overflow: auto;
  592. max-height: 420px;
  593. white-space: pre-wrap;
  594. word-break: break-word;
  595. margin: 0;
  596. color: #334155;
  597. }
  598. .prose { line-height: 1.6; }
  599. .reasoning {
  600. background: #fffbeb;
  601. border: 1px solid #fde68a;
  602. border-radius: 8px;
  603. padding: 0.75rem;
  604. margin-bottom: 1rem;
  605. }
  606. .msg-list { display: flex; flex-direction: column; gap: 0.4rem; }
  607. .msg {
  608. border: 1px solid var(--border);
  609. border-radius: 6px;
  610. background: #f8fafc;
  611. }
  612. .msg summary {
  613. cursor: pointer;
  614. padding: 0.45rem 0.65rem;
  615. display: flex;
  616. align-items: center;
  617. gap: 0.5rem;
  618. list-style: none;
  619. }
  620. .msg summary::-webkit-details-marker { display: none; }
  621. .msg-body { padding: 0 0.65rem 0.65rem; }
  622. .msg-preview { color: var(--muted); font-size: 0.78rem; overflow: hidden; text-overflow: ellipsis; white-space: nowrap; flex: 1; }
  623. .badge {
  624. font-size: 0.65rem;
  625. font-weight: 600;
  626. text-transform: uppercase;
  627. padding: 0.12rem 0.4rem;
  628. border-radius: 4px;
  629. font-family: var(--mono);
  630. color: #fff;
  631. }
  632. .role-system { background: #475569; }
  633. .role-user { background: #2563eb; }
  634. .role-assistant { background: #059669; }
  635. .role-tool { background: #d97706; }
  636. .chip-row { display: flex; flex-wrap: wrap; gap: 0.35rem; margin-bottom: 0.5rem; }
  637. .chip {
  638. font-family: var(--mono);
  639. font-size: 0.72rem;
  640. background: #fff7ed;
  641. border: 1px solid #fdba74;
  642. color: #c2410c;
  643. padding: 0.15rem 0.5rem;
  644. border-radius: 999px;
  645. }
  646. .usage {
  647. display: flex;
  648. flex-wrap: wrap;
  649. gap: 0.75rem;
  650. margin-top: 0.75rem;
  651. font-family: var(--mono);
  652. font-size: 0.72rem;
  653. color: var(--muted);
  654. }
  655. .sysprompt-block { margin: 0.85rem 0; }
  656. .markdown-box {
  657. background: var(--code-bg);
  658. border: 1px solid var(--border);
  659. border-radius: 6px;
  660. padding: 0.75rem 1rem;
  661. max-height: 420px;
  662. overflow: auto;
  663. }
  664. .markdown-body { font-size: 0.88rem; line-height: 1.65; color: var(--text); }
  665. .markdown-body > *:first-child { margin-top: 0; }
  666. .markdown-body > *:last-child { margin-bottom: 0; }
  667. .markdown-body p { margin: 0.5rem 0; }
  668. .markdown-body h1,
  669. .markdown-body h2,
  670. .markdown-body h3,
  671. .markdown-body h4,
  672. .markdown-body h5,
  673. .markdown-body h6 {
  674. margin: 1rem 0 0.5rem;
  675. line-height: 1.35;
  676. color: var(--text);
  677. }
  678. .markdown-body h1 { font-size: 1.15rem; }
  679. .markdown-body h2 { font-size: 1.05rem; }
  680. .markdown-body h3 { font-size: 0.98rem; }
  681. .markdown-body h4 { font-size: 0.9rem; }
  682. .markdown-body ul,
  683. .markdown-body ol { margin: 0.4rem 0; padding-left: 1.4rem; }
  684. .markdown-body li { margin: 0.2rem 0; }
  685. .markdown-body li > p { margin: 0.2rem 0; }
  686. .markdown-body code {
  687. background: #eef2f7;
  688. border-radius: 4px;
  689. padding: 0.1rem 0.35rem;
  690. }
  691. .markdown-body pre {
  692. background: #0f172a;
  693. color: #e2e8f0;
  694. border-radius: 6px;
  695. padding: 0.65rem 0.85rem;
  696. overflow: auto;
  697. margin: 0.5rem 0;
  698. }
  699. .markdown-body pre code { background: transparent; padding: 0; color: inherit; }
  700. .markdown-body blockquote {
  701. border-left: 3px solid var(--border);
  702. margin: 0.5rem 0;
  703. padding: 0.1rem 0.75rem;
  704. color: var(--muted);
  705. }
  706. .markdown-body table { border-collapse: collapse; margin: 0.5rem 0; font-size: 0.82rem; }
  707. .markdown-body th,
  708. .markdown-body td { border: 1px solid var(--border); padding: 0.3rem 0.55rem; }
  709. .markdown-body a { text-decoration: underline; }
  710. .markdown-body strong { font-weight: 600; }
  711. .markdown-body hr { border: none; border-top: 1px solid var(--border); margin: 0.75rem 0; }
  712. code { font-family: var(--mono); font-size: 0.85em; }
  713. @media (max-width: 900px) {
  714. .layout { grid-template-columns: 1fr; }
  715. .sidebar { position: relative; height: auto; max-height: 40vh; }
  716. }
  717. """
  718. def _render_system_prompt_block(system_prompt: str | None) -> str:
  719. if not system_prompt:
  720. return ""
  721. return f"""
  722. <div class="sysprompt-block">
  723. <div class="sublabel">System Prompt</div>
  724. {_render_markdown(system_prompt)}
  725. </div>
  726. """
  727. def _render_available_tools_block(tool_names: list[str]) -> str:
  728. if not tool_names:
  729. return ""
  730. chips = "".join(f'<span class="chip">{_esc(n)}</span>' for n in tool_names)
  731. return f"""
  732. <div class="sublabel">可用工具({len(tool_names)})</div>
  733. <div class="chip-row">{chips}</div>
  734. """
  735. def render_html(events: list[dict[str, Any]]) -> str:
  736. """Render a full standalone HTML page for the given events."""
  737. meta = summarize_run(events)
  738. skills = meta.get("skills_used") or []
  739. skills_str = ", ".join(skills) if skills else "—"
  740. system_prompt, tool_names = _extract_system_prompt_and_tools(events)
  741. return f"""<!DOCTYPE html>
  742. <html lang="zh-CN">
  743. <head>
  744. <meta charset="utf-8" />
  745. <meta name="viewport" content="width=device-width, initial-scale=1" />
  746. <title>Agent Run · {_esc(meta.get("run_id") or "unknown")}</title>
  747. <style>{_CSS}</style>
  748. </head>
  749. <body>
  750. <div class="layout">
  751. <aside class="sidebar">
  752. <h1>Agent Trace</h1>
  753. <div class="run-id">{_esc(meta.get("agent_name") or "agent")}</div>
  754. <div class="run-id">{_esc(meta.get("run_id"))}</div>
  755. <nav>
  756. {_nav_items(events)}
  757. </nav>
  758. </aside>
  759. <main class="main">
  760. <section class="hero">
  761. <h2>运行概览</h2>
  762. <div class="stats">
  763. <div class="stat"><div class="label">Agent</div><div class="value">{_esc(meta.get("agent_name") or "—")}</div></div>
  764. <div class="stat"><div class="label">Model</div><div class="value">{_esc(meta.get("model") or "—")}</div></div>
  765. <div class="stat"><div class="label">Iterations</div><div class="value">{_esc(meta.get("iterations"))}</div></div>
  766. <div class="stat"><div class="label">Tool Calls</div><div class="value">{_esc(meta.get("tool_calls_made"))}</div></div>
  767. <div class="stat"><div class="label">Events</div><div class="value">{_esc(meta.get("event_count"))}</div></div>
  768. <div class="stat"><div class="label">Skills</div><div class="value">{_esc(skills_str)}</div></div>
  769. </div>
  770. {_render_available_tools_block(tool_names)}
  771. {_render_system_prompt_block(system_prompt)}
  772. <div class="sublabel">用户输入</div>
  773. <div class="user-prompt">{_esc(meta.get("user_input") or "—")}</div>
  774. {f'''
  775. <div class="final">
  776. <h3>最终回答</h3>
  777. {_render_markdown(meta.get("final_content"), soft_breaks=True, boxed=False)}
  778. </div>
  779. ''' if meta.get("final_content") else ""}
  780. </section>
  781. <section class="timeline">
  782. <h2 style="margin:0 0 0.5rem;font-size:1.1rem">执行时间线</h2>
  783. <p class="muted" style="margin:0 0 1rem">按步骤展示:LLM 输入 → 思考/输出</p>
  784. {_render_timeline(events)}
  785. </section>
  786. </main>
  787. </div>
  788. </body>
  789. </html>
  790. """
  791. def generate_visualization(
  792. run_path: Path | str,
  793. output: Path | str | None = None,
  794. ) -> Path:
  795. """
  796. Load a run log and write an HTML visualization.
  797. Returns the output HTML path.
  798. """
  799. run_path = Path(run_path)
  800. events = load_run_events(run_path)
  801. if not events:
  802. raise ValueError(f"No events found in {run_path}")
  803. html_doc = render_html(events)
  804. if output is None:
  805. # Prefer placing next to the source file
  806. src = run_path
  807. if src.suffix in {".log", ".jsonl"}:
  808. out = src.with_suffix(".html")
  809. else:
  810. out = Path(str(src) + ".html")
  811. else:
  812. out = Path(output)
  813. out.parent.mkdir(parents=True, exist_ok=True)
  814. out.write_text(html_doc, encoding="utf-8")
  815. return out