DeepSeek 流量超 Google 升至第二,每 token 均价降 13.6%:8 月网关指数

AI小蝌蚪AI 前沿📡 觉醒AI2026-09-19934 阅读💛 300 收藏

Vercel AI Gateway 每月在生产应用和 AI 实验室之间路由数十万亿 token。8 月指数报告的是 2026 年 7 月采集的数据。

8 月指数核心数据:

  • 平均每 token 支付价格 7 月下降 13.6%(5 月曾上涨近 20%),流量增长太快,即使花费增长 37%,单价仍是两位数下降
  • DeepSeek 成为按 token 流量计的第二大实验室,跑的量是 Google 的两倍以上
  • Anthropic 以 30% 的流量收下 65% 的网关花费,单 token 均价是其他实验室平均的 4.4 倍
  • 图片和视频双榜单换主:Google 的 Nano Banana 图片量超过 OpenAI 的 GPT Image,字节 Seedance 在视频量和花费上双领先

Kimi K3 发布即冲进智能体工作

月之暗面 7 月 16 日发布 Kimi K3。和 6 月发布的智谱 GLM 5.2 一样,它为长程智能体工作而生,所以从第一天起用量就很重:单请求 token 量约为前代 K2.5 的 12 倍。

它扩张得很快:日流量在发布周和 7 月最后一周之间翻了三倍,月底时单请求重量已经和 Claude Opus 4.8 相当,7 月最后一个完整日按 token 流量排在网关第八。

需求是新增的而不是转移的:K3 在两周内处理了 Kimi 家族近三分之二的 token,到最后一周达到 82%,而家族其他成员的量只轻微下降。

开源权重 7 月的花费份额翻倍有余,达到 8.6%,其中 90% 以上的增长来自月之暗面和智谱。月之暗面在网关总花费的份额翻了四倍到 2.3%。便宜的开源权重模型几个月来一直在拿量不拿钱,Kimi K3 和 GLM 5.2 是第一批以超过 DeepSeek 单价 11 倍以上的价格拿下可观流量的模型。

DeepSeek 流量升至第二

6 月报告说 DeepSeek 加入了流量争夺,7 月报告说开源权重实验室即将升到第二——7 月,DeepSeek 超过 Google 正式拿到第二。4 月 Google 跑着网关近 40% 的流量、DeepSeek 不足 1%;到 7 月,DeepSeek 跑四分之一,是 Google 11% 的两倍多。它最便宜的 DeepSeek V4 Flash 一个模型跑的 token 就超过 Google 全部模型加起来。

反转集中在消费侧工作:Google 的个人助理 token 份额一个月内腰斩以上,DeepSeek 的涨了三倍多,Google 让出的份额大部分流向 DeepSeek。V4 Flash 7 月跑的 token 比网关任何其他模型都多,接近总量的五分之一,比第二名多 70%。

开源权重此前只占住市场最便宜的一端,流量份额从 4 月的 11% 涨到 6 月的 29%,花费占比始终不足 4%。7 月量继续涨到 36%,花费打破惯性翻倍有余,达到每美元约 9 美分——指数历史上最高。四大前沿实验室合计的花费份额七个月来首次跌破 93%,降到 89%,跌幅主要来自 Google;DeepSeek 的花费份额几乎没动。买家按任务所需分层选模型,再在层内按价格选:DeepSeek 和 Opus 从来没有正面竞争过,GLM 5.2 和 Kimi K3 是第一批真正承接闭源实验室工作负载的开源权重模型。

平均每 token 价格下降 13.6%

公司 7 月买了更多推理、更多跑在便宜模型上:流量涨 59%、花费涨 37%、均价降 13.6%。如果维持 6 月的模型组合,均价本应基本持平——降幅全部来自公司主动改路由。以 OpenAI 为例:平均每个 OpenAI token 的成本降到 6 月的 58%,因为新增流量的 85% 都给了 GPT-5 家族最便宜的 GPT-5-Nano。

在两个月都跑超千万 token 的数千团队中,四分之三替换了至少十分之一的模型组合,五分之三改了至少四分之一。中位数团队的单 token 成本降 2.9%,但只有六分之一的团队保持在起点 5% 以内——四分之一团队砍成本 30% 以上(多为起点高于均价的),另四分之一至少多付 20%(多为起点低于均价的),贵的往下走,便宜的往上走。

7 月 81% 的 token 跑在六个月前还不在网关上的模型。网关花费自 5 月以来涨 74%,流量翻倍。

Anthropic 的溢价反而扩大

Anthropic 在已测量的每个月都保持 60% 以上花费份额。7 月它以 30% 的流量收下 65.1% 花费,单 token 均价是其他所有实验室平均的 4.4 倍(6 月是 3.4 倍)。部分涨幅来自 Claude Fable 5:7 月 1 日结束三周出口管制停售回归后,迅速涨到网关总花费的 13.2%,仅次于 Opus 4.8。在编程智能体这个网关最大用例中,Anthropic 拿走 80% 以上花费。

Anthropic 没有模型在市场的最底端:最便宜的 Haiku 4.5 单价约为网关均价的三分之二,而 OpenAI 的 GPT-5-Nano 是六分之一、DeepSeek 的 V4 Flash 是十六分之一。在 OpenAI 或 Google 上省钱的客户可以留在自家目录里,在 Anthropic 上省钱就意味着离开 Anthropic——而它仍然拿走了网关大部分花费。溢价就是”便宜档能做到的”和”客户需要做成的”之间的差距。在 AI Gateway 上切换模型只是改一行配置,没有任何锁定:Fable 5 回归后日流量几乎精确回到停售前水平,但 7 月使用它的团队九成是新的——工作回来了,客户换了人。

图片归 Google,视频归字节

6 月 OpenAI 的 GPT Image 还是网关图片第一,7 月 Google 的 Nano Banana 以 45% 对 42% 反超,花费几乎对半;Nano Banana 的涨幅几乎全部来自 Gemini 3.1 Flash Lite Image 一个模型——Google 在流量跌到第四的同月拿下了图片第一。字节 Seedance 在视频量和花费上双领先,6 月的量冠军 xAI Grok Imagine 落到第二,中国实验室收走视频花费的约七成。

原文信息

作者:Vercel 官方账号(@vercel)

原文地址:

文章评论(0

暂无评论,快来抢沙发~