54.6万亿Token中国占一半:OpenRouter 7月第二周全球AI大模型调用量深度解读

7月13日,OpenRouter发布了7月第二周(7月6日-12日)的全球AI大模型调用量数据。

几个数字足以说明一切:全球总调用量54.6万亿Token,其中中国模型贡献了27.58万亿——占比超过50%,连续十一周位居全球第一。

更扎眼的是Top 10榜单:十个席位里,中国模型占了八个,美国只剩AnthropicClaude Opus 4.7和4.8守住两席。OpenAI和Google,双双出局。

这不是一周的数据波动,而是一个已经持续了半年的结构性趋势。

一、一张表看懂本周全球AI调用榜

54.6万亿Token中国占一半:OpenRouter 7月第二周全球AI大模型调用量深度解读
54.6万亿
全球总调用量(Token)
↑ 12.6%
27.58万亿
中国模型调用量
↑ 17.61%
6.33万亿
美国模型调用量
↑ 47.9%
11周
中国连续领先
全球第一

本周关键变化

中国模型份额增长轨迹

从4.5%到50%:一年完成跃迁

2025年上半年
4.5%
过去12个月均值
11%
2026年2月起
30%+
峰值
46%
本周
50%+

二、Top 10的"8:2"格局意味着什么?

54.6万亿Token中国占一半:OpenRouter 7月第二周全球AI大模型调用量深度解读

上周OpenRouter调用量Top 10中,中国模型占据了八个席位:

🇨🇳 前六名全部是中国模型

1
腾讯Hy3 (free)

6.13万亿Token · 新晋冠军
2
DeepSeek V4 Flash

5.31万亿Token · 此前七连冠
3
小米MiMo-V2.5

中国模型
4
智谱GLM 5.2

MIT开源
5
MiniMax M3

中国模型
6
DeepSeek V4 Pro

中国模型

🇺🇸 仅存的两席

A
Claude Opus 4.7

Anthropic
A
Claude Opus 4.8

Anthropic

OpenAI和Google完全不在Top 10之列。这在一年前是不可想象的——OpenRouter曾是美国模型的主场。

在全球开发者用真金白银投票的"日常干活"市场上,中国模型已经成为默认选项。不是偶尔用用,而是主力生产。

三、Hy3登顶:腾讯的"免费核弹"

54.6万亿Token中国占一半:OpenRouter 7月第二周全球AI大模型调用量深度解读

本周最大的变化是腾讯混元Hy3(free)以6.13万亿Token的周调用量登顶,一举终结了DeepSeek-V4-Flash的七连冠。

Hy3核心参数

项目详情
发布日期2026年7月6日(正式版)
总参数2950亿(295B)
激活参数每次推理仅210亿(21B)
架构MoE混合专家(192路由专家 + 1共享专家,Top-8)
上下文256K Token
开源协议Apache 2.0(完全可商用)
免费期至2026年7月21日

性能表现

基准测试Hy3得分说明
SWE-bench Verified78.0代码能力
SWE-bench Pro57.9超越DeepSeek V4 Pro
WildClawBench前列超过GLM-5.1和DeepSeek V4 Pro
任务成功率(WorkBuddy内测)90%从预览版72%大幅提升
幻觉率5.4%较预览版减半

行业评价:"整体能力第二梯队上沿、低成本模型第一梯队"——不是最强的,但性价比极其突出。

腾讯用"限时免费+开源Apache 2.0"的组合拳,在极短时间内完成了用户获取和生态验证。发布当天腾讯股价上涨4.82%,市场显然买账。

冷静声音:Agent从业者赵江杰指出:Hy3目前在中低难度任务上表现优秀,核心架构设计和敏感操作仍不适合无监督交付。"真正的考验,要等到免费期结束之后。"

四、英伟达入局:Nemotron 3 Ultra首次上榜

另一个值得关注的信号是英伟达Nemotron 3 Ultra首次进入OpenRouter榜单

这不只是多了一个新模型。英伟达作为全球最大的AI芯片供应商,现在也开始直接参与模型层的竞争。当你的GPU卖给所有人,你自己也下场做模型,这个信号的含义远比一次排名更深远。

结合此前的Nemotron-TwoTower架构探索,英伟达正在从"卖铲子"向"既卖铲子又挖金矿"转型。对于依赖英伟达硬件的整个AI生态来说,这是一个需要长期关注的变量。

五、成本鸿沟:100倍价差背后的底层逻辑

54.6万亿Token中国占一半:OpenRouter 7月第二周全球AI大模型调用量深度解读

为什么全球开发者在用脚投票?答案很简单:

当前主流模型输出Token定价

模型输出价格(每百万Token)对比
DeepSeek V4 Flash$0.28最便宜
千问 Qwen 3.6 Max$1.20
智谱 GLM-5.2 (MIT)$4.40
Claude Sonnet 5*$10.00(8月31日后涨至$15)
GPT-5.5$30.00最贵

最便宜的中国模型和最贵的美国模型之间,价差接近100倍

OpenRouter Justin Summerville 总结三大驱动力
1. 便宜60%-90% — 第一驱动力
2. 性能追平 — 差距缩小到6-9个月
3. 开源可自托管 — 数据主权可控

布鲁金斯学会的Kyle Chan估计,中国模型目前落后美国顶级模型"6到9个月",但运行成本只是"一小部分"。

在Agent工作负载下,这种成本差距会被进一步放大——一个Agent任务可能调用模型50到200次,每次调用的价差都会累积。Vercel的Harpreet Arora说得很直白:

"当任务不需要最好的模型时,团队开始把它路由给最便宜的够用模型——而最近这波中国模型正在赢得这笔交易。"

六、中美博弈:两端同时收紧

54.6万亿Token中国占一半:OpenRouter 7月第二周全球AI大模型调用量深度解读

但这个故事不只是"谁更便宜"。地缘政治正在从两端同时收紧。

🇺🇸
美国方面

众议院中国问题特别委员会和国土安全委员会已联合调查使用中国AI的美国企业。Airbnb使用阿里千问Cursor母公司Anysphere接入月之暗面Kimi,都在审查范围内。

🇨🇳
中国方面

路透社7月7日报道,商务部正与阿里、字节、智谱等讨论限制最先进AI模型的海外访问。拟议框架分三层:基础开源模型需备案,高级模型需安全审查,前沿模型可能限制仅国内使用。

这意味着什么?你的生产依赖可能被任何一方的政策切断。

Hugging Face的Yacine Jernite指出了一个结构性风险:"用户可能被迫在性能强但昂贵、价格和可达性随时变化的美国闭源模型,和想要控制成本或掌握AI栈时唯一可行的中国模型之间做选择。"

务实策略:按任务分层路由

  • 高并发、低敏感度的Agent循环 → 中国模型(成本优势)
  • 面向客户输出、涉及合规数据 → 美国模型(合规安全)
  • 核心能力 → 自托管开源模型(数据主权)

关键提醒:不要硬绑定任何单一模型。在政策环境仍在变化时,这是最大的基础设施风险。

写在最后

54.6万亿Token,中国占一半。这不是一个短期现象,而是一个从2025年初开始、持续加速了18个月的结构性转变。

从4.5%到50%,中国大模型用了一年时间在OpenRouter上完成了从"边缘"到"主流"的跃迁。驱动力是成本、性能和开源生态的三重叠加;阻力是地缘政治和信任成本。

但开发者是务实的。当你的Agent每天调用模型200次,每次价差100倍,任何政治正确都挡不住账单。

📅 下周关注点

7月21日:腾讯Hy3免费期结束,看付费转化率
Nemotron 3 Ultra:英伟达的后续排名变化
Claude Sonnet 5:上线第二周能否进入Top 10
中国模型出口管制:商务部讨论的后续进展

暂无评论

暂无评论...
NavCN AI工具导航

NavCN是一个专业的AI工具导航网站,收录最新AI工具和热门AI应用,涵盖AI写作、AI绘画、AI视频、AI办公、AI编程等1000+AI工具,并提供AI工具推荐、评测和教程,帮助用户快速找到好用的AI工具。

Copyright © 2026 NavCN 桂ICP备2026002643号-2  Design by NavCN