实时监控所有OpenClaw智能体的Token用量及预估成本,提供告警与优化建议以控制预算。
代理成本监视器 — 了解您的代理成本是一项面向实际任务的技能,主要用于追踪您所有 OpenClaw 代理的代理的标识使用、 成本和效率;在您浪费预算前获得提醒。
从功能定位来看,该技能强调把分散的操作要求整理成清晰、可复用的处理流程,使用户能够围绕既定目标快速准备输入、选择执行方式并获得结构化结果。实际使用前应先确认任务范围、数据来源、运行环境、必要权限和关键参数,再依据技能说明逐步执行;
若输入条件不完整,应先补齐信息或采用保守配置,避免因错误假设导致结果偏离需求。执行过程中需要关注工具调用是否成功、接口或依赖是否可用、输出格式是否符合预期,并对异常提示、缺失字段和边界情况进行处理;涉及批量任务时,还应保存进度,避免中断后重复操作。
实时追踪所有 OpenClaw Agent 的 Token 使用量、费用及运行效率,并在预算超支前及时发出告警。
同时运行多个 Agent 功能强大——但若缺乏监控,成本可能迅速攀升:
当被触发(通过 cron 或手动调用)时,Agent 将执行以下操作:
session_status向您的监控 Agent(或任意具备此技能的 Agent)发起如下请求:
"为所有 Agent 生成一份成本报告" "今天哪个 Agent 消耗的 Token 最多?" "我这周会触达速率限制吗?"
{
"name": "Daily Cost Report",
"schedule": { "kind": "cron", "expr": "0 20 * * *", "tz": "Europe/Berlin" },
"payload": {
"kind": "agentTurn",
"message": "Run a cost report across all agents. Check session_status for each. Report: total tokens, cost per agent, top spender, budget warnings. Send summary to user."
},
"sessionTarget": "isolated",
"delivery": { "mode": "announce" }
}
生成报告时,请采用如下结构:
## 💰 Agent 成本报告 — [日期] ### 各 Agent 明细 | Agent | 模型 | Token 数量(24 小时) | 预估费用 | 状态 | |-------|------|------------------------|-----------|------| | Central | Opus 4.6 | 125K | $1.87 | ⚠️ 较高 | | Techops | Opus 4.6 | 89K | $1.33 | ✅ 正常 | | Atlas | Sonnet 4.5 | 45K | $0.27 | ✅ 较低 | | Closer | Haiku 4.5 | 23K | $0.02 | ✅ 极低 | | Heartbeats | Ollama | 12K | $0.00 | ✅ 免费 | ### 汇总 - **24 小时总计:** 294K tokens(约 $3.49) - **本周预估:** 约 $24.43 - **预算:** $20/周 → ⚠️ 预估超支至 122% ### 优化建议 1. 将 Techops 的常规任务由 Opus 切换至 Sonnet(可降本 40%) 2. 将心跳间隔由 15 分钟延长至 30 分钟 3. 在 Atlas 上启用上下文裁剪(context pruning),避免空闲会话持续消耗缓存
请依据下表进行费用估算:
| 模型 | 输入 / 1M | 输出 / 1M | 缓存读取 / 1M | 缓存写入 / 1M |
|---|---|---|---|---|
| Opus 4.6 | $5.00 | $25.00 | $0.50 | $6.25 |
| Sonnet 4.5 | $3.00 | $15.00 | $0.30 | $3.75 |
| Haiku 4.5 | $1.00 | $5.00 | $0.08 | $1.25 |
| 模型 | 费用 | 适用场景 |
|---|---|---|
| Ollama(本地) | $0 | 心跳、简单任务 |
| Gemini OAuth | $0* | 备用方案(受速率限制) |
* 免费额度含速率限制
{ "heartbeat": { "model": "ollama/llama3.2:3b" } }
节省:100% 的心跳成本(若使用 Opus,每周可节省 $5–$10)
{ "anthropic/claude-haiku-4-5": { "params": { "cacheRetention": "none" } } }
节省:在低成本模型上避免缓存写入开销(不值得缓存)
{ "contextPruning": { "mode": "cache-ttl", "ttl": "5m" } }
节省:每轮对话中避免重复读取过期上下文
{ "anthropic/claude-opus-4-6": { "params": { "cacheRetention": "long" } } }
节省:避免每轮对话重复发送系统提示词(单次节省幅度最大)
| 任务类型 | 推荐使用 | 不建议使用 | 预计节省 |
|---|---|---|---|
| 协调类任务、复杂推理 | Opus | — | 合理开销 |
| 财务分析、数据处理 | Sonnet | Opus | -40% |
| 销售文案、营销内容草稿 | Haiku | Sonnet | -67% |
| 心跳、健康检查 | Ollama | 任何付费模型 | -100% |
| 推文草稿 | Haiku 或 Grok | Opus | -80% |
{ "session": { "reset": { "mode": "daily", "atHour": 4, "idleMinutes": 45 } } }
{ "compaction": { "memoryFlush": { "enabled": true } } }
请在监控 Agent 的 memory 中配置:
## 预算告警 - 日预算:$5.00(达 80% 即 $4.00 时告警) - 周预算:$20.00(达 70% 即 $14.00 时告警) - 单 Agent 日上限:$2.00 - 告警通道:Telegram 私信
若您已部署 DevOps/监控 Agent(例如您的 DevOps Agent),请在该 Agent 的 AGENTS.md 中添加:
## 成本监控 - 每日 20:00 执行成本报告 - 若任一 Agent 单日费用超 $2,则立即告警 - 每周一 09:00 发送周度汇总 - 追踪趋势:用量呈上升还是下降?
Q:该技能是否会发起 API 调用?
A:不会。它仅调用 OpenClaw 内置的 session_status 工具,不依赖任何外部 API,亦不产生额外费用。
Q:费用估算准确度如何?
A:基于官方发布的模型定价。实际费用可能因缓存命中率而略有浮动;当前估算偏保守(略高于实际)。
Q:能否按单次对话(conversation)追踪费用?
A:暂不支持。费用按会话(session)粒度统计。如需查看各会话 Token 数量,请使用 sessions_list 工具。
Q:是否支持非 Anthropic 模型?
A:支持。Token 统计适用于所有提供商;费用估算需已知定价信息(您可在“模型费用参考”章节中补充自定义费率)。