Futurum Group 首席执行官 Daniel Newman 在 X 动态中表示,AI 代理目前的 AI 使用量是人类的 5 倍,预计这一比例将达到 10 倍甚至更高。Andreessen Horowitz(a16z)基于 OpenRouter 数据得出的数据显示,截至 8 月,代理的代币用量为 7.3 万亿,而人类为 1.4 万亿;此时距离代理使用量首次超过人类使用量已有 6 个月。根据 a16z 引用的 OpenRouter 数据,缓存提示词占代理代币用量的 85% 以上,推动了这一激增。OpenRouter 追踪其 AI 模型网关平台上的代币用量,并使用加权综合评分将 API 密钥分为代理型、混合型或人类型流量。随着用于存储这些上下文的 KV 缓存增长速度超过 GPU 高带宽内存(HBM)容量,这一趋势引发了对内存容量的担忧,并可能加剧预计将持续至 2028 年的 RAM 短缺。
Newman 预计代理与人类的代币比例将达到 10 倍
Newman 在他的 X 动态中写道:“目前 AI 的使用量是人类使用量的 5 倍。这一数字将加速达到 10 倍,然后越来越高。”他的数据引用了 a16z 的一张 OpenRouter 数据图表,该图表显示,截至 8 月,代理的代币用量为 7.3 万亿,而人类为 1.4 万亿。OpenRouter 洞察负责人 Peter Walker 将这些数据称为“OpenRouter 上按类型划分的 7 日平均代币用量”,并表示自 2 月的交叉点以来,代理的代币使用量增加了 14 倍,而人类使用量增加了 2.8 倍。
OpenRouter 使用“包含工具调用率、轮次、间隔时间等输入的 7 项信号加权综合评分”,将每个 API 密钥分为代理型、混合型或人类型。根据原始数据计算,混合型类别同期增长了 4.7 倍。这些数据衡量的是单个平台的代币用量,4 月和 7 月出现了下降。
缓存提示词占代理代币用量的 85% 以上
a16z 引用 OpenRouter 的数据写道,超过 85% 的代理代币来自缓存提示词。根据 a16z 的说法,缓存代币几乎贡献了代币用量相对增长的全部部分。模型将存储的上下文保存在 KV 缓存中,a16z 指出:“KV 缓存的增长速度超过了 GPU HBM 容量。”
一家测试租用的英伟达 H200 的呼叫中心咨询公司报告称,其代理在 9 月使用 Claude Code 时也出现了类似模式,并表示“其所有输入中有 96% 都是在重新读取旧对话”。缓存代币的成本远低于从头处理提示词,但仍需要内存存储。
麦肯锡调查显示,40% 的大型组织正在扩大 AI 代理应用
在麦肯锡的《2026 年 AI 状况调查》中,来自大型组织的受访者中有 40% 表示正在扩大 AI 代理的应用,高于一年前的 27%。代理采用率的增长已超出 OpenRouter 的平台数据范围。
随着 KV 缓存需求增长,美光预计 RAM 短缺将持续至 2028 年
美光预计,2027 年和 2028 年 RAM 与存储设备短缺将进一步恶化,客户支付的费用将高于今年。内存制造商正优先为 AI 数据中心生产 HBM。a16z 将对高带宽内存不断增长的需求与缓存代币用量的增长联系起来。
常见问题
当前 AI 代理代币用量与人类使用量的比例是多少?
Futurum Group 首席执行官 Daniel Newman 表示,AI 代理目前使用的代币数量是人类的 5 倍,而 OpenRouter 数据显示,截至 8 月,代理的代币用量为 7.3 万亿,人类为 1.4 万亿。
为什么 AI 代理使用的代币数量显著多于人类?
根据 a16z 引用的 OpenRouter 数据,超过 85% 的代理代币来自缓存提示词,这意味着代理主要是在重新读取已经看过的内容,而不是处理完全新的提示词。
大型组织中的 AI 代理采用率提高了多少?
麦肯锡的《2026 年 AI 状况调查》显示,来自大型组织的受访者中有 40% 表示正在扩大 AI 代理的应用,高于一年前的 27%。
免责声明:以上内容(如有图片或视频亦包括在内)均为平台用户上传并发布,本平台仅提供信息存储服务,对本页面内容所引致的错误、不确或遗漏,概不负任何法律责任,相关信息仅供参考。
本站尊重他人的知识产权、名誉权等法律法规所规定的合法权益!如网页中刊载的文章或图片涉及侵权,请提供相关的权利证明和身份证明发送邮件到qklwk88@163.com,本站相关工作人员将会进行核查处理回复