>> 长江证券-软件与服务行业AI应用正当时:国产大模型调用量首超美国,看好大模型出海与商业化落地进展加速-260303
| 上传日期: |
2026/3/4 |
大小: |
600KB |
| 格式: |
pdf 共5页 |
来源: |
长江证券 |
| 评级: |
看好 |
作者: |
宗建树 |
| 下载权限: |
此报告为加密报告 |
|
|
事件描述 近期,中国AI的模型调用量爆发式增长,OpenRouter平台调用量首次超过美国。 事件评论 中国AI的模型调用量爆发式增长,OpenRouter平台调用量首次超过美国。全球最大的AI模型API聚合平台OpenRouter数据显示,9日~15日这周,中国模型以4.12万亿Token的调用量,首次超过同期美国模型的2.94万亿Token。16日~22日这周,中国模型的周调用量进一步冲高至5.16万亿Token,三周增长127%,而同期美国模型调用量跌至2.7万亿Token。与此同时,全球调用量排名前五的模型中,中国模型占据四席,这股强大的增长动能并非依赖单一爆款产品,而是中国AI厂商集群式崛起。 进入2026年,国产模型加速迭代,能力明显提升。2026年2月16日至22日的周榜单显示,平台调用量排名前五的模型中,有四款来自中国厂商,分别为MiniMax的M2.5、月之暗面的KimiK2.5、智谱的GLM-5以及DeepSeek的V3.2。四款模型合计贡献了Top5总调用量的85.7%。具体来看,(1)MiniMax于2026年2月13日发布M2.5模型,2月9日至15日当周平台总调用量增加的3.21万亿Token中,M2.5贡献1.44万亿Token增量。(2)月之暗面于1月27日发布KimiK2.5,凭借原生多模态架构和强大的Agent并行处理能力,调用量连续提升。Kimi在发布KimiK2.5后不到一个月的累计收入已超过其2025年全年的总收入,增长主要由全球付费用户及API调用量大涨共同推动。(3)智谱的旗舰模型GLM-5于2月12日发布,用户规模高速增长。(4)a16z与OpenRouter联合发布的报告显示,Qwen全系列模型总Token调用量以5.59万亿位居全球第二,仅次于DeepSeek(14.37万亿)。中国大模型B端市场,2025年下半年,千问(Qwen)系列模型的日均Token调用量占比32.1%位列第一,相较上半年的17.7%几乎翻倍。 价格竞争力依旧显著,国产大模型出海与商业化落地有望加速。输入价格来看,MiniMaxM2.5与GLM-5,价格均为0.3美元/百万Token。Claude Opus4.6的价格为5美元/百万Token,是中国这两款模型的约16.7倍。在输出价格来看,MiniMax-M2.5价格为1.1美元/百万Token,智谱GLM-5为2.55美元/百万Token,Claude Opus4.6则为25美元/百万Token,分别是前两者的约22.7倍和9.8倍。除了算法架构的革新,中国AI厂商还在积极探索“垂直整合”的路径,以进一步压缩每一个Token背后的成本。 我们认为,国产AI大模型正在发生价值质变,Token正从互联网流量成为AI时代的“水电煤”,新商业模式一触即发。2026年将会是大模型商业化爆发元年,核心变化是1)从卖算力到卖Token;2)文生视频迎来2025年Coding时刻;3)入口侧重构,互联网CSP迎来分化;4)Agent时代来临,AI从对话时代转向执行时代。重视三条主线:新入口&大模型商业化爆发、国产芯片(CPU+GPU)&第三方云、Agent重构软件。 风险提示 1、AI技术发展不及预期; 2、下游应用需求不及预期
|
|