
凭借 token 吞吐量的迅猛增长,DeepSeek 在七月跃升为第二大 AI 服务提供商,其处理的 token 数量超过 Google 的两倍。据 Vercel 最新发布的 AI Gateway 生产指数显示,今年四月,DeepSeek 通过该网关处理的 token 总量占比尚不足 1%,而 Google 接近 40%;到了七月,DeepSeek 份额飙升至 25%,Google 则回落至 10.7%。
用量激增与成本下降并存
随着企业加速采用 AI 技术,七月通过 AI Gateway 处理的 token 总量较六月增长 59%,总支出增加 37%,但作为计算单位的每 token 平均价格却下降了 13.6%。这是自五月以来,每 token 平均成本首次出现明显下降。
总支出增加而单价下降,源于企业模型使用策略的转变。组织正转向更便宜的模型处理更多任务,并主动调整模型组合。在六、七月均处理超过 1000 万 token 的企业团队中,四分之三的团队至少改变了 10% 的模型组合比例,其中五分之三的团队调整幅度甚至超过 25%。
DeepSeek V4 Flash 作为该公司最便宜的模型,仅在七月处理的 token 数量就超过了所有 Google 模型的总和,单独贡献了 AI Gatewaytoken 总量的近五分之一。
开放权重模型崛起
增长不仅限于 DeepSeek。七月,开放权重模型(Open-weight models)合计占据总 token 量的 36%,而四月这一数字仅为 11%。其在支出中的份额也从不足 4% 上升至 8.6%,这主要得益于 Moonshot 和 Z.ai 等新模型的出现。
向廉价模型的转移直接拉低了平均 AI 成本。数据显示,若模型组合保持不变,七月每 token 的平均价格本应与六月基本持平。这一趋势在 OpenAI 模型上同样显著:七月其平均每 token 价格比六月低 42%,新增 token 量中有 85% 流向了 GPT-5 系列中最便宜的 GPT-5-Nano。
高端模型仍占据支出大头
尽管廉价模型使用率激增,但价格并非所有应用的决定性因素。Anthropic 在七月负责了 29.8% 的 token 量,却获得了 AI Gateway 上 65.1% 的支出,其每 token 平均价格是其他所有 AI 提供商平均水平的 4.4 倍。
这种差异在 " 编码代理 "(coding agents)场景中尤为明显。作为按 token 量计算的最大应用场景,DeepSeek 在此类别中处理了近三分之一的 token,而 Anthropic 则拿走了超过 80% 的支出。
数据表明,AI 市场正按应用类型进一步细分:廉价模型承载着越来越大的 AI 总体量,而高端模型则在企业愿意支付溢价的关键应用中,保留了巨大的支出份额。自五月以来,通过 AI Gateway 的支出已增长 74%,token 总量翻番,意味着企业在购买更多 AI 能力的同时,每美元投入获得的 token 数量显著增加。
【星途科讯 图文丨三一一 首发于 ZAKER 科技,转载请注明出处】


登录后才可以发布评论哦
打开小程序可以发布评论哦