
①数据显示,中国AI大模型周调用量为40.48万亿Token,环比增长9.88%,连续十七周超过美国,居全球首位。 ②券商分析师刘高畅认为,数据释放出的核心信号,是国产模型从“技术榜单上的可用”,走向“国际开发者工作流中的高频使用”。但Token调用量不等同于海外收入。
《科创板日报》9月1日讯(记者 王耐)2026年,被行业视为大模型出海元年。
OpenRouter数据显示,中国AI大模型周调用量(8月17日至8月23日)为40.48万亿Token,环比增长9.88%,周调用量连续十七周超过美国,居全球首位。
调用量持续走高的同时,最近,一款“隐身模型”的登场让海外开发者社区炸了锅。8月20日深夜,一款名为Ox Alpha的模型以“隐身模型”身份上架OpenRouter。上线后,迅速冲至平台调用量榜首,六天后,被智谱正式认领:Ox Alpha是GLM系列新一代模型。
两件事放在一起看,都展示了国产模型在全球AI圈的权重和声量。
“数据释放出的核心信号,是国产模型已经从‘技术榜单上的可用’,进一步走向‘国际开发者工作流中的高频使用’,特别是在编程、Agent、长上下文等高Token消耗场景中形成了规模优势。”国金证券计算机首席分析师刘高畅表示。
但刘高畅也提醒,OpenRouter的数据可以证明中国模型在这一国际模型聚合平台上的流量很强,却不能直接等同于全球市场份额、海外用户数量,更不能直接等同于国产模型厂商取得了同等规模的海外收入。
调用量第一的模型 是收入第一的模型吗?
在OpenRouter,模型排名实时更新,排名指标包括周使用量、模型在平台上的消费金额、编程智能体单次会话的使用成本、市场份额、基准测试、工具调用占比等等。
模型周 Token 调用量排名指标关注度很高。截至8月24日,总 Token 规模达到 113T。智谱 GLM5.3 Flash(Ox Alpha)、DeepSeek V4 Flash 0731、小米 MiMo‑V2.5、GPT‑5.6 Luna、腾讯 Hy3,位居 Token 量前列,国产多个模型 Token 量级达到 10T 级别。
值得注意的是,“Others” 其他模型周 Token 调用量合计 40.8T,占比很高,大量新模型仍然不断涌入市场。

不过,Token调用量不等于付费收入,不等于实际花销。
哪些任务用户付费意愿更高?OpenRouter数据中,按头部模型的任务花费占比(share of spend),分了四大类。除了通用任务 32.4%、代码任务 30.3%之外,智能体 Agent 任务排名第三,占比 28.7%,数据处理排第四,占比8.7%。
记者发现,打开不同任务的模型排行榜单,不同任务的最优模型差异较大,不存在一款模型通吃全部的付费场景。
比如最近关注度颇高的工作任务执行(Workflow Execution),占平台全部消费的 18.7%,是 OpenRouter 上付费价值最高的细分任务之一。

按付费占比排名,榜单第一名是 Anthropic 的 Claude Opus5,消费占比 13.2%,说明在复杂工作流任务里,高端 Claude 依然是付费客户的首选。国产模型Kimi K3(月之暗面)高居第 2 位,占比 9.5%,智谱 GLM5.2 排第 4、DeepSeek V4 Pro 0423 排第 6,前十里面国产模型占据 3 席。
这也说明,作为大模型的兵家必争之地,高端复杂 Agent 工作流并没有被单一模型垄断。Anthropic 的高端模型保有优势,但国产的 Kimi、GLM、DeepSeek 在付费维度已经可以和 OpenAI 同台竞争。
国金证券计算机首席分析师刘高畅认为,国产模型连续多周保持较高Token规模,说明它们不再只是新模型发布后被集中测试,而是越来越多地进入真实应用链路。尤其是编程助手和Agent,一项任务可能包含多轮规划、代码生成、工具调用、错误修复和上下文回传,单次任务消耗的Token远高于普通聊天。国产模型凭借较好的性价比在这类场景中获得流量,是有实际产业意义的。


不过,如果以Workflow Execution为评估尺度,把Token量占比(share of tokens)和付费占比(share of spend)两个表格放在一起看,国产模型确实存在高Token调用量,但由于单次单价低,付费金额占比不匹配的现实矛盾。
不过,专家也提醒,在模型的商业化落地中,各项排名和指标只是参考项,而且商业化价值的全面体现,更应关注实际业务层面的落地和ROI,而非纸面数据。刘高畅指出,“榜单中的Token调用量不等于请求次数、用户数量或者收入。一个模型Token更多,可能是用户更多,也可能是上下文更长、输出更冗长,或者少数高强度应用贡献了大量流量。Token首先是工作负载指标,不是财务指标。”
出海的国产模型 正在撕掉“低价标签”?
近期,一向被称为“价格屠夫”的DeepSeek也上调了价格。比如DeepSeek-V4-Pro相比于此前每百万Tokens输入(缓存命中)0.025元、输入(缓存未命中)3元、输出6元的价格,高峰时段涨幅最高达1100%。
刘高畅认为,DeepSeek此次价格调整部分项目相对旧价涨幅很大,说明DeepSeek正在从统一低价获客,转向按模型能力、时延和峰值容量做收益管理,也说明厂商认为模型质量、用户黏性和生产可用性已经具备一定定价权。
专家也提醒,涨价只是扩大了毛利空间,不等于已经盈利,也不意味着价格战结束。是否盈利仍取决于输入与输出结构、缓存命中率、硬件利用率、企业折扣、坏账和研发摊销。价格提高后,如果用户迅速迁移到第三方托管版本或其他模型,原厂未必能获得预期收益;如果峰值需求迫使厂商大量预留算力,实际成本也可能继续偏高。
“未来竞争不会只是‘谁最便宜’,而是比单位任务成功成本,也就是完成一项真实工作需要多少Token、多少重试、多少人工纠错,以及能否提供稳定SLA、区域部署、数据保护和企业支持。”
刘高畅进一步补充道,判断海外闭环是否真正打通,“我更关注付费Token占比、原厂端点占比、90天留存、企业合同、输出Token结构、缓存命中率和单位Token毛利,而不是单周调用量。未来最有可能率先跑通的,不一定是单纯卖最便宜Token的公司,而是同时掌握高效推理、差异化模型、海外渠道、本地合规和企业服务能力的厂商。”
与此同时,行业也经常将“模型出海” 和 “Token 出海” 混为一谈。中国信通院人工智能研究所国际发展部主任许珊曾在采访中表示,“Token出海”在物理意义上还未实现,其本质依然是“模型出海”。OpenRouter上显示的中国大模型服务提供方,其数据中心实体多部署在海外,海外开发者实际使用的是部署在海外云平台上的大模型服务。
中国电信研究院行业与企业战略研究所所长、高级工程师饶少阳也表示,对于Token出海的长远发展,中国AI将经历规模红利期、生态扎根期、价值主导期三阶段渐进式升级。
目前国内大厂的海外营收情况如何?
近期,国内AI厂商的半年报也相继发布,不少大厂的海外营收都非常亮眼。

比如MiniMax上半年海外市场收入达到 7083 万美元,占总收入的 60.8%。这一比例较2025年全年73%在下降,但绝对值仍在增长。
月之暗面方面,截至6月中旬,ARR(年度经常性收入)突破3亿美元。Kimi B端负责人黄震昕透露,Kimi海外付费用户增长400%,API收入增长400%。
根据Ramp 2026 年6 月5万余家美企账单支付数据,DeepSeek 登顶当月软件趋势榜,Coinbase、Lindy 等美国企业直接付费采购,并非仅采用开源权重本地部署。
字节“先圈地,后盖楼“的扩张策略和打发同样在海外上演。凭借免费模式、低门槛订阅和本地化策略,AI豆包海外版Dola在东南亚、拉美等市场快速崛起。2026年第一季度,Dola单季下载量超过7200万次,环比增长47%,累计下载量在本季度正式突破2亿次。2026年Q1,Dola超越ChatGPT成为东南亚下载量最高的AI应用,并在拉美市场仅次于ChatGPT。
AI内容制作方面,昆仑万维2026年上半年实现营收53.59亿元,海外收入52.03亿元,同比增长51.21%。
快手可灵第二季度AI营业收入超过8.5亿元,同比增长超200%。一季度数据显示,可灵收入约75%来自海外市场,付费形式中API与订阅收入之比为6:4。今年前五个月为可灵贡献最多API收入的十大客户中,有八家来自海外。