Token 用量追踪
wesclaw 提供细粒度的 Token 用量追踪功能,帮助你了解 AI 对话的资源消耗情况。
查看 Token 用量
在记忆中心的"用量"标签页中,你可以查看:
- 总消耗:输入 Token 和输出 Token 的汇总
- 按模型分组:不同模型各消耗了多少 Token
- 按时间分布:每日/每周的消耗趋势
多维度查询
Token 用量支持多个维度的分组和过滤:
分组维度(GroupBy)
| 维度 | 说明 |
|---|---|
model | 按使用的模型分组 |
agent | 按 Agent 分组 |
session | 按会话分组 |
day | 按日期分组 |
过滤条件
- 时间范围:指定开始和结束时间(
From/To) - 模型:只看特定模型的消耗
- 会话:只看特定会话的消耗
- 标签:按 Actor 等标签过滤
聚合摘要
Token 用量聚合摘要(Summary)提供快速概览:
- 总输入 Token 数
- 总输出 Token 数
- 使用的模型数量
- 活跃会话数量
- 时间跨度
按 Agent 和日期聚合
GET /observe/token-usage/aggregate 端点提供更灵活的聚合:
- 按 Agent 分组查看各 Agent 的消耗占比
- 按日分组查看消耗趋势
- 指定天数范围(如最近 7 天、30 天)
与 WES 计费的关系
如果你使用 WES 平台 Provider(wes: 前缀):
- 平台会根据模型费率表自动计费
- Token 消耗直接扣减平台钱包余额
- 本地 Token 用量追踪与平台计费独立——本地记录的是原始 Token 数,平台计算的是费用
- 自有 Provider(BYOK)的 Token 消耗只记录本地,不经过平台结算
桌面版的特殊性
wesclaw 桌面版的 Token 追踪完全在本地:
- 数据存储在 Cell 的
state.db中 - 无需联网即可查看历史用量
- 不会上报到外部服务
Run 级别的追踪
每次 Run(一轮对话交互)结束时,引擎会记录:
- 该 Run 消耗的输入/输出 Token
- 使用的模型和 Provider
- 工具调用的详细信息
- Run 的总时长
你可以在"运行日志"中查看每次 Run 的详细追踪。
控制 Token 消耗
一些减少 Token 消耗的建议:
- 精简对话:提供清晰简洁的指令,减少来回澄清
- 善用 Plan:多步任务让 AI 一次性规划,减少零散交互
- 选择合适模型:简单任务用小模型,复杂任务用大模型
- 利用记忆:让 AI 记住常用偏好,避免每次重复说明
相关文档
- 计费与钱包 →
billing-wallet.md - Provider 配置 →
provider-setup.md - 可观测性 →
observability.md - 多模型切换 →
multi-model.md