HeronSentry
HeronSentry 是独立可用的 AI Agent 观测面:通过标准 OTLP 采集 Agent 运行时事件,提供调用链查询、 成本聚合、告警与性能导出;不依赖套件其它产品即可单独部署。

HeronSentry
Observability Platform独立可用的 AI Agent 观测面:追踪、成本、告警与性能分析Agent 在做什么、做得怎么样、花了多少——标准 OTLP 接入,一眼可见。
- OTLP
- 开放协议;语义字段按 profile 映射
- 全量
- 默认不采样
- 实时同步入库
- 请求内完成持久化
- 独立
- 零套件依赖即可部署
典型痛点
- Agent 出故障只能看日志,没有调用链
- 成本到月底才知道,超支已成事实
- 看不见某个 Agent 是否健康、是否被滥用
核心价值
运行时异常告警与 webhook 外发
错误率、成本突增、采集积压与同工具高频调用可经 webhook 外发(需配置地址);延迟尖刺、孤儿 Span 默认不走 webhook,仍写入告警页。

逐个 Agent 的延迟、错误率与截断率
HeronSentry 按 Agent 汇总响应延迟、流式首字延迟(TTFT)、错误率与截断率,连同最近使用的模型与供应商,呈现在 AULO 控制台的 Agent 详情里。

按模型、宿主机与 Agent 看 Token 和费用
HeronSentry 采集的 Token 用量与费用,在 AULO 资源总览里按模型、按宿主机、按 Agent 分组排开,哪个模型、哪台机器上的哪个 Agent 用得最多,一屏可见。

按模型与 Agent 归集项目费用
HeronSentry 把一个项目的 Token 与费用按模型、按 Agent 归集,并拆出输入、缓存命中与输出三类 Token;预算利用率来自 PathPilot。

告警规则的阈值与启停
HeronSentry 的告警规则在 AULO 里逐条列出触发条件、阈值与严重度,可按来源筛选,也可单条启停。

核心能力
数据接入
追踪与可视化
成本与性能
告警
能做 / 不做
能做
- 标准 OTLP 协议接收:全面支持 Traces / Metrics / Logs 实时入库
- 端到端分布式调用链:还原 Agent 思考、工具调用与模型交互拓扑
- 精细化 Token 成本核算:按缓存读写拆分,支持实时成本归因与分析
- 多维度智能告警:错误率、成本突增、积压与异常调用的实时告警及 Webhook
- Agent 专项可靠性指标:首字延迟(TTFT)、截断率、工具拒绝率分析
- 数据分析与审计导出:为 OwlAudit 及管理层提供指标与审计数据支撑
不做
- 不作为通用企业海量全文检索日志中心(专注于 Agent 运行时关联的 OTLP 结构化链路与日志)
- 不替代主机与网络级基础设施监控(专注于 Agent 应用层与大模型交互语义层观测)
- 不执行主动任务干预与阻断(仅负责只读观测与告警,拦截动作归 OwlAudit / NodalOS)
按角色看
技术负责人
标准 OTLP 接入,不锁定特定框架;可与现有观测栈并存,但不宣称复用其后端
合规与风控
OwlAudit 可从本服务拉取运行导出
业务负责人
成本归因清晰,Agent 投入产出可衡量
集成与依赖
NodalOS OTLP 推送(需在 NodalOS 侧开启自身遥测上报)AULO 告警页PathPilot 成本回写与运行健康(错误率 / P95 / 超时)OwlAudit 可拉取 traces / 成本 / 告警导出