数据监控用于查看原子服务的调用情况,包括请求量、Token 消耗、耗时、成功率等指标,帮助您了解服务用量、评估计费成本并及时发现异常。
进入数据监控
1. 登录 腾讯云 ES 控制台。
2. 在左侧导航栏选择 智能搜索开发 > 原子服务,进入原子服务列表页。
3. 单击目标服务名称,进入服务详情页。
4. 选择 数据监控 标签页。
页面结构

数据监控页面分为两个区域:
区域 | 说明 |
数据概览 | 统计当前自然月的服务调用数据,并对比上一个自然月的数据 |
实时数据 | 按所选时间范围和粒度展示各指标的趋势图表 |
数据概览
数据概览统计当前自然月的服务调用数据,并展示上一个自然月的数据作为对比,便于快速判断用量变化趋势。
指标 | 说明 |
请求量(次) | 指定时间范围内推理服务接收到的请求总数 |
Token 消耗(tokens) | 推理服务处理请求所消耗的 Token 总量,直接关联计费,LLM 会有输入和输出 Token 之分 |
解析页数(页) | 涉及文档解析的处理数量 |
图片向量化(张) | 涉及图片向量化处理的请求次数 |
平均耗时(ms) | 推理服务处理单次请求的平均响应时间 |
成功率(%) | 推理请求成功处理的比例 |
实时数据
实时数据以图表形式展示各指标随时间的变化趋势,用于定位具体时间点的异常。
筛选条件
筛选项 | 说明 |
时间范围 | 选择查询的时间跨度,如 1 小时。也可通过右侧日期控件自定义起止时间 |
时间粒度 | 数据聚合的时间精度,如 1 分钟粒度。时间范围越长,建议粒度越粗 |
服务 | 筛选具体的模型服务,默认 全选,即展示该原子服务下所有模型的数据 |
提供 导出数据 功能,可将当前筛选条件下的监控数据导出,用于离线分析或留档。
图表区上方提供 数据对比 按钮,可将当前时间段与另一时间段的数据叠加展示,便于对比变更前后的效果(如调整模型或优化调用逻辑后的性能变化)。
监控指标
指标 | 说明 |
请求量(次) | 指定时间范围内推理服务接收到的请求总数 |
Token 消耗(tokens) | 推理服务处理请求所消耗的 Token 总量,直接关联计费,LLM 会有输入和输出 Token 之分 |
解析页数(页) | 涉及文档解析的处理数量 |
图片识别(次) | 在调用文档解析接口时,开启图片识别次数 |
图片向量化(张) | 涉及图片向量化处理的请求次数 |
平均耗时(ms) | 推理服务处理单次请求的平均响应时间 |
成功率(%) | 推理请求成功处理的比例 |
异常率(%) | 推理请求处理失败或超时的比例 |
使用建议
成本监控:以 Token 消耗为主要观察指标,若发现某个模型的 Token 消耗异常偏高,检查是否存在重复调用或输入文本过长的问题。
性能排查:平均耗时突增时,先看请求量是否同步上涨。若请求量平稳但耗时上升,可能是单次输入内容变长;若两者同步上涨,则可能触及限流。
异常定位:成功率下降或异常率上升时,将时间粒度调细(如 1 分钟粒度)定位到具体时间点,再结合业务侧日志排查。持续异常需检查 API Key 是否有效、是否触发限流、资源包是否耗尽。
模型选型参考:通过按模型拆分的耗时和 Token 消耗曲线,对比不同模型的性能与成本,为生产环境的模型选择提供数据依据。
变更效果验证:调整模型或优化调用逻辑后,使用 数据对比 功能叠加变更前后的数据,量化评估改动效果。