>> 国证国际-软件与互联网行业动态分析:大模型密集更新,调用量维持强劲,支撑AI投资逻辑-251003
| 上传日期: |
2025/10/3 |
大小: |
955KB |
| 格式: |
pdf 共5页 |
来源: |
国证国际 |
| 评级: |
-- |
作者: |
王婷 |
| 下载权限: |
无限制-登录即可下载 |
|
|
我们观察到最近两周国内外大模型密集发布新模型,在模型效率优化和技术迭代上均有明显提升,同时大模型调用量维持强劲增长趋势。我们认为由大模型驱动的业务仍是投资主线,具备短期催化剂+长期商业化潜力的特征,建议持续关注。 报告摘要 模型调用量维持强劲增长趋势:据Open Router数据,9月17日-30日的两周内,xAI的模型token日均调用量为2,620亿,位列第一,主要因Grok Code Fast 1的极致性价比价格(百万tokens输入/输出价格仅为0.2美元/1.5美元)。Alphabet Gemini系列模型的日均调用量为1,320亿,OpenAI为820亿,分别位列第二、三。中国大模型方面,DeepSeek日均调用量为750亿,阿里Qwen为260亿,保持平稳。全球大模型调用量总体维持强劲增长(图表1)。 阿里巴巴:9月24日发布多款新模型:1)旗舰模型Qwen3-Max,总参数超万亿;2)Qwen3-VL(视觉语言处理)thinking版本多模态推理SOTA水平。3)升级Qwen3Coder,编码效率提升。此外,通义千问系列模型下载量已超6亿,衍生模型规模超17万(全球领先)。 快手:9月26日,发布可灵2.5 Turbo模型,视频生成的可控性&稳定性&一致性提升,同时定价下调30%。10月2日,Artificial Intelligence更新视频生成模型基准测试,可灵2.5 Turbo在文生视频和图生视频均位列第一,处于SOTA水平。 DeepSeek:9月29日,发布DeepSeek-V3.2-Exp模型(实验版本),引入稀疏注意力机制,提升长文本训练和推理效率。同时下调API价格,百万tokens输出价格为3元,较DeepSeek V3.1 Terminus降85%(基于Artificial Intelligence数据)。同时,该模型的开源算子包含TileLang、CUDA两个版本,TileLang为面向GPU算子开发的国产编程语言,由北京大学计算机学院主导开发并于2025年1月开源。DeepSeek当前的模型迭代方向已展项出适配国产算力芯片的趋势,利好国产芯片硬件与软件生态闭环。 OpenAI:10月1日,OpenAI发布新一代视频生成模型Sora 2,首次实现对现实世界物理规律的精准模拟,并可同步生成环境音效,OpenAI认为是视频生成领域的“GPT-3.5时刻”。同时,宣布推出名为Sora的社交软件,iOS版已在美国&加拿大上线,基于Sora2的AI原生视频社交,功能类似AI版TikTok。Sora2及Sora App目前仍在邀请制内测阶段。此外,据Information报道,OpenAI在2025年上半年实现收入43亿美元,较2024年全年高16%,净亏损135亿美元。目前估值约5,000亿美元,较2025年4月(3,000亿美元)提升67%。OpenAI将于10月6日举行2025 OpenAIDevDay开发者日,预计将有大模型相关更新发布。 Anthropic:9月29日,发布Claude Sonnet 4.5模型,性能较上代优化,SWE-benchVerified(软件编码)基准测试中,准确率为77.2%,为行业领先。可实现长达30小时的连续任务处理。此外,定价与Sonnet 4一致,百万tokens输入/输出价格为3美元/15美元。9月完成F轮融资后,Anthropic估值达1,830亿美元。 投资建议:当前大模型在模型架构、效率优化、GPU芯片适配等方向快速迭代更新,同时推理需求仍在快速增长阶段,我们认为大模型产业链投资仍有可观投资回报,建议关注阿里巴巴(9988.HK/BABA.US),受益于大模型+云计算+自研GPU芯片生态;快手(1024.HK),受益于可灵AI的技术迭代和商业化潜力。 风险:大模型技术迭代迅速,领先优势或持续较短时间;商业化进展不及预期。
|
|