AI智能体消耗的Token已超过人类
The Decoder··作者 Matthias Bastian
关键信息
Walker指出,智能体token使用量中将近70%来自缓存提示词,而这些缓存读取的计费远低于新的输入token。OpenRouter还更偏向开放权重模型,这类模型通常比OpenAI或Anthropic的模型更不节省token,因此这些数字未必能完全代表更广泛的市场。
资讯摘要
OpenRouter的数据表明,AI智能体正在迅速成为该平台最大的token消费者。根据OpenRouter分析师Peter Walker的说法,2026年2月6日可能是人类最后一次消耗的token多于AI智能体。从那以后,智能体的使用量增长了14倍,而人类使用量只增长了2.8倍。报道指出,智能体越来越多地独立运行更长时间,并在工作过程中不断唤起额外的AI进程。这意味着AI系统本身正在制造更多AI工作负载。
不过,原始token数量并不等于相同幅度的成本增长。智能体token使用量中将近70%来自缓存提示词,而缓存读取的计费远低于未缓存输入。OpenRouter自己的文档也说明,prompt caching属于输入侧计费,缓存读取与新输入token的价格不同。文章还提到,OpenRouter的数据结构偏向开放权重模型,而这类模型通常比OpenAI或Anthropic的模型更不节省token。因此,这组数据很有参考价值,但并不能完全代表整个行业。
这篇报道的核心结论是,token通胀已经在智能体和重推理工作负载中显现。推理模型往往会在回复前思考更久,即使任务本身并不需要这么多token,也会增加消耗。文章认为,这种趋势很可能不只存在于OpenRouter,而是也会出现在主要实验室的模型中。换句话说,AI不只是帮助人类产出更多内容,它也越来越多地在为自己的推理服务创造需求。

资讯正文
随着 agentic token 使用量飙升 14 倍,AI 正在成为 AI 自己最大的客户
AI 正在越来越多地使用 AI。根据 OpenRouter 分析师 Peter Walker 的说法,2026 年 2 月 6 日可能是人类消耗的 token 数量最后一次超过 AI agents 的一天。从那以后,agentic token 的使用量增长了 14 倍,而人类使用量仅增长了 2.8 倍。Agents 正在越来越多地独立工作,持续时间也越来越长,并在过程中启动更多 AI 进程。不过,近 70% 的 agent token 使用量来自缓存提示词,这些提示词的计费费率低得多,因此实际成本上涨的速度并没有原始数据看起来那么快。
OpenRouter 的流量偏向于开源权重模型,而这类模型往往比 OpenAI 或 Anthropic 的模型 token 效率更低。不过,这一趋势在各大实验室中大概率也类似。token 通胀早已随着推理模型开始出现,这类模型在回应之前会思考更久,即使它们本不该如此。
来源与参考
收录于 2026-08-24