通过Vercel AI网关,开源权重AI模型在令牌使用量上首次占据多数地位。最新生产指数显示,8月份开源权重模型处理了全部令牌的56%,而4月份这一比例仅为13%。这意味着开源模型处理的令牌数量已超越所有闭源权重模型的总和。与此同时,每令牌平均价格环比下降23.2%,这是连续第三个月下跌,也是自4月以来最显著的一次降幅。

尽管用量激增,开源权重模型在8月份仅占AI网关总支出的14%。对于月用量超过1000万令牌的头部团队,每令牌的中位数成本下降了7.6%,降幅较7月的2.9%翻倍。数据表明,在选择AI模型时,性价比正成为关键决策因素。

巨头内部的“消费降级”

Anthropic的产品组合中出现了明显的向低价模型转移趋势。Claude Fable 5在总支出中的份额从7月的13.2%骤降至8月的4.9%,而价格约为其一半的Opus 5使用量则增长至22.5%。九成使用Fable 5的团队减少了用量,其中大部分转向了Opus 5。尽管内部结构发生变化,Anthropic在8月份仍占据了AI网关所有支出的64%,自去年12月以来,其月度支出占比始终保持在61%以上。

OpenAI也呈现出类似的高端与平价模型分化格局。9月3日上线的GPT-6 Astra,每令牌费用是GPT-5.6 Sol的两倍,但在两天内即占据OpenAI模型总支出的三分之一,随后占比在28%至39%间波动。在与Anthropic同日推出的Fable 5.1对比中,Astra在前12天的网关支出占比达7.7%,是Fable 5.1(3.7%)的两倍多,覆盖公司数量也为其两倍。

高端模型的成本集中度极高。9月4日至16日期间,GPT-6 Astra和GPT-5.6 Sol共同处理了OpenAI 27%的令牌,却消耗了71%的支出;相比之下,Luna和Nano处理的令牌数量是前两者的两倍多,支出却低了九倍。

专用模型 adoption 提速

专用AI模型正迅速获得市场认可。TypeSafe AI推出的Jev模型在发布后24小时内,被近13%的付费团队采用,创下AI网关历史上最快采用速度纪录。此前其他近期模型在24小时后的采用率均低于7%。Jev专注于软件内的结构化决策,提供可直接被代码调用的结构化答案而非自由文本,其快速普及表明专业模型在生产环境中正迅速找到立足点。

综上,AI网关数据揭示了一个清晰趋势:价格敏感度正在重塑模型选择格局。开源及低价模型承担了越来越多的令牌吞吐量,而高端模型仍牢牢占据支出大头。开发团队正根据具体应用场景的需求与预算,更精细地权衡模型组合。