1. 活动合约
一排进入 agent_run_outcomes,并明确查询所使用的类型。
- timestamp_utc
- Timestamp
- workflow
- Utf8
- model
- Utf8
- status
- Utf8
- reviewer_outcome
- Utf8
- human_handoff
- Boolean
它是如何运作的
每次完成的智能体运行或业务操作选择一行。记录状态、持续时间、工作流程、发布、移交、成本和安全关联标识符。
当工具和模型回答已知的可靠性、成本或质量问题时,记录工具和模型请求事件。不要复制整个跟踪或敏感负载。
记录验收、人工审核、任务成功或其他明确的产品结果,然后将版本与审核的 SQL 和完整分母进行比较。

Telemetry 中的 AI 智能体结果事件
实际的 Telemetry 工作区显示用于检查智能体运行、工具调用和终端结果的事件表和 SQL 界面。
边界
可检查的证明路径
此示例使用声明的架构、只读 SQL 和确定性合成结果。它演示了工作流程,但没有提供示例数据作为客户基准。
一排进入 agent_run_outcomes,并明确查询所使用的类型。
哪些智能体工作流程成功完成并产生可接受的结果?
SELECT
workflow,
model,
COUNT(*) AS runs,
100.0 * SUM(CASE WHEN status = 'success' THEN 1 ELSE 0 END)
/ NULLIF(COUNT(*), 0) AS technical_success_rate_pct,
100.0 * SUM(CASE WHEN reviewer_outcome = 'accepted' THEN 1 ELSE 0 END)
/ NULLIF(SUM(CASE
WHEN reviewer_outcome <> 'not_reviewed' THEN 1 ELSE 0
END), 0) AS reviewed_acceptance_rate_pct,
100.0 * SUM(CASE WHEN human_handoff THEN 1 ELSE 0 END)
/ NULLIF(COUNT(*), 0) AS human_handoff_rate_pct,
AVG(duration_ms) AS average_duration_ms,
SUM(estimated_cost_usd) / NULLIF(COUNT(*), 0) AS cost_per_run_usd
FROM agent_run_outcomes
WHERE timestamp_utc >= now() - INTERVAL '30 days'
GROUP BY workflow, model
HAVING COUNT(*) >= 20
ORDER BY reviewed_acceptance_rate_pct, runs DESC;退款审核在技术上完成,但比其他工作流程需要更多的修改或人工接管。
| 工作流程 | model | runs |
|---|---|---|
| support_triage | configured-model-a | 1840 |
| refund_review | configured-model-b | 620 |
| knowledge_draft | configured-model-a | 940 |
能力
特定于智能体的设置路径
从 智能体遥测skill.md 指南,然后将相同的已审查遥测边界带入重点 Claude Code、Cursor 或 Codex 实现路径中。
看分析
按工作流程和模型比较智能体任务成功率、审阅者接受度、成本、延迟和人工切换率。
打开查询示例根据共享工作流标识符重建有序的跨服务工作流步骤和经过的时间。
打开查询示例查找智能体运行重复调用一小组工具但未取得成功结果的情况。
打开查询示例将模型支出与已接受、已保存或其他有用的产品结果联系起来。
打开查询示例将模型支出、代币、请求量和每个请求的成本归因于产品功能。
打开查询示例过滤点嵌套字段并对失败的工具进行排名,而无需展平原始事件负载。
打开查询示例客户案例
相关能力