TGViewer
开发者工具箱|编程·开发工具·资源 开发者工具箱|编程·开发工具·资源 @devtoolboxhub · 559 subscribers
Post #1211 5
用 Conversation ID 追踪 AI Agent 实际工作链

Agent 可观测性常犯一个错:精确记录模型调用、提示词和 token,却在 Agent 真正开始操作软件时失去追踪。这种痕迹看起来很干净,事故却无法定位。Honeycomb 的 Agent Timeline 仪表指南指出,GenAI span 应涵盖 Agent 引发的所有工作:模型调用、工具调用、任务移交、下游服务、数据库查询和后台任务。Conversation ID 是跨 trace、服务、多轮交互的用户级工作单元,它决定了团队拿到的是完整的 trace 还是一堆无法关联的 span。

OpenTelemetry GenAI agent-span 规范要求 gen_ai.conversation.id 仅在真实标识存在时填充,不得回退到 UUID、trace ID 或内容哈希。每个 agent 还需分配唯一的 gen_ai.agent.name,子 agent 不能继承父名称。同时在 collector 层对 prompt 等敏感内容做脱敏,避免数据蔓延。Trace 不应止于遥测收集,而应成为评估、回归检测和发布门禁的控制面。Candidly 的案例显示,trace 特征预测客户对话是否解决的 AUC 达到 0.90。


先从产品会话边界注入真实 conversation ID,贯穿 Agent 运行时、LLM 调用、工具执行、队列和数据库,然后在测试环境主动制造故障来验证链路完整性。Agent 可观测性遵循的是 Agent 引发的实际工作,Conversation ID 是贯穿这根链条的线索。

#开发者 #工具 #AIAgent #ConversationID #OpenTelemetry #Honeycomb #LangSmith #AgentObservability #可观测性
@DevToolboxHub
More from @devtoolboxhub
  1. Oct 2, 2026功能开关正在变成没人清理的技术债 功能开关(Feature Flag)是现代软件交付里最有效的工具之一:支持灰度发布、A/B 实验、未发布功能门控,以及生产环境的即时熔断开关。但这…
  2. Oct 2, 2026containerd 检查点恢复路径默认关闭 Kubernetes 里策略变成进程状态只有一处,就是创建。检查点恢复是通往运行进程的第二条路,而这条路上没有任何环节决定:当保存的状…
  3. Oct 1, 2026给 AI 代理建一份「自欺清单」 维也纳邮政与邮件服务商 Postservice.at 创始人 Stephan Holzbach 不是开发者,但今年公司大部分工作跑在 Claude…
  4. Oct 1, 2026代码评审评论为何比本意更刺耳 一条评审评论大约四十秒写完,通常夹在两件事之间,写的人清楚自己的语气。读的人刚在这份代码上花了三天,正想收尾,而且听不到你的声音,于是自己补上一种语气…
  5. Oct 1, 2026用 Hindsight 给客服 Agent 加上持久记忆 大多数客服 Agent 只擅长回答眼前这条消息。真正难的是同一个客户一周后再来,Agent 完全不知道之前发生过什么。作者…
  6. Sep 30, 2026AMSI 绕过技术 2026 开发者指南 AMSI(Antivirus Malware Scan Interface)是 Windows 的恶意脚本扫描接口,覆盖 PowerShe…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →