DeepSeek V4 一月抢下 17% 流量:低成本模型首次大规模进入生产

林知秋AI 前沿📡 觉醒AI2026-09-19133 阅读💛 165 收藏

Vercel 每月通过 AI Gateway 在生产应用和 AI 实验室之间路由数十万亿 token。这份 5 月生产指数给出了榜单和基准测试之外的视角:真实的生产 AI 用量长什么样。

5 月指数核心数据:

  • AI Gateway 总 token 环比增长 20%,总花费环比增长 43%,客户平均每个 token 比 4 月多付近 20%
  • DeepSeek 的 token 份额单月从不足 1% 跳到 17%,花费份额却停在 1% 附近
  • Anthropic 的花费份额从 61% 涨到 65%,在所有高风险用例(AI 应用生成、后台智能体、编程智能体)中占 70-80% 花费
  • 成本意识催生了低成本模型和前沿模型之间更聪明的路由

上个月科技新闻的头条还是”token 预算爆了”:Uber 在 Q1 结束后不久烧穿了年度 Claude Code 预算,亚马逊关掉 KiroRank 来遏制无效的 token 灌水。失控成本是真问题,但本月报告显示生产场景的花费仍在增长。

低成本模型第一次拿下可观的生产流量

2 月到 4 月,各实验室在 AI Gateway 上的流量分布变化缓慢。5 月,DeepSeek V4 的发布彻底改写了 token 份额版图:4 月几乎不存在的低成本端,一个月内变成网关第三大流量来源,而整体花费几乎没有变化。

4 月 DeepSeek 占 AI Gateway token 不足 1%、花费不足 0.2%;5 月流量份额跳到 17%,超过 OpenAI 排第三。流量几乎全部来自 5 月发布的两个模型:deepseek-v4-flash 和 deepseek-v4-pro。

价格是关键变量。DeepSeek V4 Flash 定价每百万 token 输入 0.14 美元、输出 0.28 美元,比同档 Anthropic 模型便宜 20-50 倍,比 Qwen 3.6 Plus、Kimi K2.6 这类性价比旗舰便宜 8-12 倍。但光靠价格解释不了单月如此大的迁移——团队拿 DeepSeek V4 跑自己的评估集,发现输出质量”够格上线”,而不只是”便宜到值得试试”。价值档模型一直存在于 AI Gateway,但从未在这个规模上拿下份额:DeepSeek V4 是第一个在自己的价位上跨过生产质量门槛的模型。

前沿实验室继续拿走新增花费的大头

低成本端流量涨得最快,昂贵端的花费涨得更快。Anthropic 的 token 份额从 26% 涨到 32%,花费份额从 61% 到 65%;OpenAI 的 token 份额稳在 13% 左右,花费份额却从 12% 微涨到 13%——客户在为每个 OpenAI token 付更多钱。

即使 DeepSeek 在拉低均价,平均 token 价格仍在上涨,因为需要前沿模型的工作增长得更快。编程智能体这个用例把低成本/前沿的分野展示得最清楚:DeepSeek 扛了该细分 49% 的 token 量,只占 4% 的成本;Anthropic 跑 28% 的 token,拿走 70% 的成本。

成本纪律变成了一种路由策略。Google 的 Gemini 3.5 Flash 5 月以高于 3.0 Flash 的价格发布,大规模迁移并没有发生——月底 3.5 只占 Flash 家族 7% 的 token,3.0 Flash 仍握着 90%。对比 Gemini 3.1 Pro 在 2、3 月间的快速迁移,说明对 3.0 Flash 满意的团队还不愿为 3.5 付溢价。

结论:便宜又能打的选项催生更聪明的模型组合

本月报告显示市场对价格越来越敏感,即使总花费和流量都在涨。数据揭示了两种优化策略:用 DeepSeek 便宜但能打的 V4 家族跑低风险高流量任务;推迟模型家族升级直到投入产出比说得通。路由让团队能够随实验室竞争实时调整模型组合和预算。

原文信息

作者:Vercel 官方账号(@vercel)

原文地址:

文章评论(0

暂无评论,快来抢沙发~