Skip to content

Token 统计与费用

「设置 → Token 统计」记录每一次 AI 调用的消耗,用来看用了多少 token、花了多少钱、缓存命中怎么样。

数据从这个功能上线后开始记录,之前的历史调用没有明细。页面实时刷新。

周期切换

顶部四个标签:今天 / 近 7 天 / 近 30 天 / 全部。切换后下面所有卡片、图表和列表同步更新。「今天」的趋势图按小时展示,其余按天。

概览

四张卡片:总消耗(输入加输出)、请求次数、费用、缓存命中率。

费用是估算值,按 models.dev 的公开单价计算:缓存读取按缓存价算,没有缓存价时按输入价的 10% 估;缓存写入按缓存写入价算,没有时按输入价的 1.25 倍估。缓存命中率是缓存输入除以总输入。

费用仅供参考

这是按公开单价估算的结果,不是账单。中转站改过价格、有折扣、或者你用的模型没有单价数据时,估算会和实际扣费不一致。以服务商后台的账单为准。

消耗趋势

折线图展示周期内的输入、输出、缓存命中三条线(蓝色输入、橙色输出、紫色缓存),线下方有半透明填充,方便辨识重叠部分。左轴是 token 数(用 k / M 缩写)。

时间轴按周期完整展开,没有记录的天或小时补 0,所以调用集中在某一天时也能正常看出走势。

渠道与模型统计

渠道统计按提供商聚合,每行显示渠道名、调用次数、输入输出消耗和占比进度条,按总消耗倒序。

模型统计按模型聚合,每行显示模型名、总输出、调用次数和调用成功率,按总消耗倒序。

调用记录

每页 10 条的明细表,底部可翻页,左右滑动看全部字段:

字段说明
调用时间年月日时分
渠道 / 模型用的哪个提供商和模型
思考强度本次调用的档位,没有档位的模型显示 -
状态success 成功 / error 失败 / cancelled 已取消
输入 / 输出 / 缓存各类 token 数
缓存命中率缓存输入除以总输入
首字延迟从请求发出到首个内容事件(文本、思考或工具调用结果)到达的时间
总耗时本次调用的总时长
预估费用没有单价数据的模型显示 -

纯工具调用的那一轮也会统计首字延迟。

重置

页面右上角的垃圾桶图标可以清空全部调用记录,统计随之归零。会弹确认框,清空后不可恢复

基于 GPL-3.0 协议开源