agent-expenditure
追踪每个AI代理的Token消耗并标记浪费
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:agent-expenditure。 它的用途是:追踪每个AI代理的Token消耗并标记浪费 完整的 Skill 内容见:https://321skill.com/skills/agent-expenditure-x-6/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
'启动agent-expenditure监控,当并行调度中的Token浪费超过10%时发送告警。' 它会自动挂载到所有AI代理的请求管道,实时统计每个代理的Token使用量,并在调度完成后输出一份包含浪费标记的详细报告,同时将告警推送至指定通知渠道。
介绍
在并行调度多个AI代理时,Token消耗容易失控,造成不必要的费用支出。该Skill能实时记录每个代理的Token使用量,自动识别并标记并行调度中的浪费行为(如重复调用、无效请求等),帮助开发者精准定位资源泄漏点。
使用方式简单:在AI开发环境中加载该Skill后,它会自动劫持代理的请求/响应流,统计每次调用的Token数,并在并行调度结束时生成报告。支持自定义浪费阈值,也可通过自然语言查询历史消耗数据。
适合需要精细控制AI调用成本的开发团队、负责多代理协同的智能体开发者,以及运维工程师。尤其是同时运行多个AI代理进行任务编排的场景。
建议在开发阶段开启详细日志,以便定位浪费模式;生产环境可设置告警阈值,避免预算超支。注意该Skill仅统计通过自身接口发起的请求,无法捕获外部直接调用的消耗。
核心特点
区别于全局Token统计工具,该Skill聚焦于单个代理级别的消耗跟踪,并能自动识别并行调度中的重复计算和无效请求,而非仅提供总量数据。
注意事项
不适用于串行调用或单代理场景,且无法统计绕过该监控直接调用API的Token消耗。
常见问题
如何查看某个代理的Token消耗明细?
通过自然语言查询,如'显示代理A的Token消耗趋势',或直接访问生成的报告文件。
什么是'并行调度中的浪费'?
指多个代理同时执行相同或重叠的请求(如重复获取同一数据),导致Token被重复消耗。该Skill会标记这些冗余调用。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/agent-expenditure-x-6/raw/index.md 读取 agent-expenditure 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/agent-expenditure-x-6/raw/index.md(查看排版版本)