功能概述
用量统计 页面帮助您全面监控 AI 资源消耗,提供两大核心能力:
用量排行(仅语言模型):按服务、模型、API Key 维度对 Token 消耗进行总量汇总与 Top 排行,支持下载明细数据。
用量趋势:以图表形式展现各项用量指标随时间的变化趋势,支持按模型、服务、API Key 多维度筛选。
用量排行
注意:
用量排行功能当前仅在语言模型标签页下提供,视觉模型与多模态理解暂不支持。
针对语言模型的 Token 消耗,提供按 服务 / 模型 / API Key 维度的总量汇总与 Top 排行,便于您快速识别用量最高的资源、定位异常消耗。

筛选条件
筛选条件 | 说明 |
统计维度 | 按在线推理服务/模型/ APIKey 汇总 Token 消耗。 |
时间范围 | 支持 1 小时、今天、近 3 天、近 7 天、近 30 天,或自定义起止时间。 |
时间粒度 | 支持按指定粒度(如 5 分钟、 1 小时)汇总趋势数据。 |
展示内容
页面同时呈现以下三类信息:
总量卡片:在选定时间范围内的 总消耗 Tokens、输入 Tokens、输出 Tokens、缓存 Tokens 总计。
总消耗 Tokens:包含输入 Token 数和输出 Token 数;
输入 Tokens:模型请求部分消耗的 Token 数量,该统计包含缓存 Tokens;
输出 Tokens:模型响应部分消耗的 Token 数量;
缓存 Tokens:命中缓存的 Token 数(仅覆盖读 cache);
排行榜:左侧列表展示选定维度下的 Top 资源(含资源名称与 Token 总数)。
趋势图:右侧柱状图按时间粒度展示各资源在不同时间区间内的消耗分布,便于识别用量峰值时段。
下载明细:排行榜右上角提供下载入口,单击下载图标即可将当前查询条件下的排行明细数据导出为本地文件,便于进一步对账或离线分析。
用量趋势
支持按模型类型分类查看,以可视化图表呈现调用趋势,每项指标均提供最大值、最小值、平均值三项统计摘要,帮助用户快速识别用量峰值与整体趋势。
模型类型 | 包含模型 |
语言模型 | DeepSeek V3、DeepSeek R1、HY-2.0、GLM-5、kimi-k2.5、MiniMax-M2.5 等 |
视觉模型 | HY-Image-3.0、Vidu-Image-q2、HY-Video-1.5、MiniMax-H3、Kling-Video-v3、Vidu-Video-q3-pro、PixVerse-Video-v6、YT-Video-2.0、HY-3D-3.0、HY-3D-3.1、HY-3D-Express 等 |
多模态理解 | HY-Vision-2.0-Instruct、HY-Vision-1.5-Thinking、HY-Vision-Video 等 |
语音模型 | WAND-ASR-V1、WAND-Dubbing-Clone-V2、MiniMax-Music-v2.6、MiniMax-Speech-2.8-HD 等 |
语言模型
调用指标:各模型在选定时间范围内的关键调用指标,统计粒度支持 1分钟 / 5分钟 / 1小时,支持配置告警。
字段 | 说明 |
总 Token 数 | 输入 Token 数 + 输出 Token 数 |
输入 Token 数 | 请求(Prompt)部分消耗的 Token 数量,包含读缓存 cache |
输出 Token 数 | 模型响应(Completion)部分消耗的 Token 数量 |
每分钟总 Token 数 | 每分钟输入 Token 数 + 每分钟输出 Token 数 |
每分钟输入 Token 数 | 每分钟输入侧的 Token 吞吐量(tokens/min) |
每分钟输出 Token 数 | 每分钟输出侧的 Token 吞吐量(tokens/min) |
每分钟读缓存 Token 数 | 单位时间内命中缓存的 Token 数 |
每分钟写入缓存 Token 数 | 单位时间内创建缓存的 Token 数(部分模型支持) |
读缓存总 token 数 | 所选区间内命中缓存的总 token 数 |
写入缓存总 token 数 | 仅特定模型支持,详情参考控制台 |
每分钟读显式缓存的 token 数 | 每分钟命中显式缓存的 token 数,仅特定模型支持 |
区间内命中显式缓存的总 token 数 | 区间内命中显式缓存的总 token 数,仅特定模型支持 |
平均输入 Token | 每请求输入 Token 的平均值 |
平均输出 Token | 每请求输出 Token 的平均值 |
其他模型
图片生成模型提供以下调用维度的趋势监控:
Token 消耗趋势:总 Token 消耗数随时间的变化走势。
任务吞吐趋势:每分钟请求次数 / 任务时长 / 图片张数 的量级变化。
失败率趋势:每分钟任务失败率随时间的变化走势。
视频生成包括 Kling、Vidu、PixVerse、MiniMax 系列,提供以下调用维度的趋势监控:
Token 消耗趋势:总 Token 消耗数随时间的变化走势。
任务吞吐趋势:每分钟请求次数 / 任务时长 / 视频时长 的量级变化。
失败率趋势:每分钟任务失败率随时间的变化走势。
视频 / 3D 生成模型包括 HY、YT 系列,提供以下调用维度的趋势监控:
任务吞吐趋势:每分钟请求次数 / 接口调用详情 的量级变化。
并发任务趋势:并发任务峰值 / 并发任务配额 使用情况。
消耗积分数详情:积分消耗量随时间的变化趋势。
语音模型提供以下调用维度的趋势监控:
Token 消耗趋势:总 Token 消耗数随时间的变化走势。
任务吞吐趋势:每分钟请求次数 / 任务时长 / 音乐数量 / 字符数 / 秒数 的量级变化。
失败率趋势:每分钟任务失败率随时间的变化走势。
字段 | 模型类型 | 说明 |
请求次数 | 视频生成: PixVerse 系列 MiniMax 系列 Kling 系列 Vidu 系列 音乐生成 语音合成 视频配音 语音识别 | 单位时间内发起的任务请求数。 |
Token 消耗数 | | 单位时间内发起的任务总 Token 消耗数。 |
错误率 | | 单位时间任务失败率。 |
任务时长 | | 单位时间内发起的任务平均耗时。 |
视频时长 | 视频生成: PixVerse 系列 MiniMax 系列 Kling 系列 Vidu 系列 | 单位时间内生成的视频平均时长。 |
音乐数量 | 音乐生成 | 单位时间内生成的音乐数量。 |
字符数 | 语音合成 | 单位时间内进行合成的字符数。 |
视频时长 | 视频配音 | 单位时间内进行配音的视频时长。 |
语音时长 | 语音识别 | 单位时间内进行识别的语音时长。 |
调用次数 | 视频生成: HY 系列 YT 系列 图像生成 3D 生成 | API 发起并执行的请求总次数,反映服务使用频次。 |
并发任务数峰值 | | 统计周期内,同一时间同时执行的任务数量的最大值,体现业务高峰期的并发压力。 |
并发任务数配额 | | 平台允许用户同时执行的最大任务数量上限,为系统可控的并发限制阈值,超出将触发限流。 |
消耗积分数 | | 调用接口过程中,根据模型、时长、并发等计费规则所扣除的积分总量,用于统计资源消耗成本。 |
时间 | 所有模型 | 请求时间区间。 |