>> 浙商证券-计算机行业大模型商业化周报:海外模型定价重构-260406
| 上传日期: |
2026/4/6 |
大小: |
456KB |
| 格式: |
pdf 共3页 |
来源: |
浙商证券 |
| 评级: |
看好 |
作者: |
刘雯蜀,刘静一,郑毅 |
| 行业名称: |
计算机 |
| 下载权限: |
此报告为加密报告 |
|
|
本周核心观察:本周大模型行业延续“密集发布+定价重构”的双线节奏 1供给端,通义在一周内连发Qwen3.5-Omni、Wan2.7-Image和Qwen 3.6 Plus三款模型,覆盖全模态理解、图像生成与高性能基座,产品快速迭代;Google则以Gemma 4开源、Veo 3.1 Lite视频生成和Flex/Priority推理分层三条线同步推进,构建从模型层到基础设施层的商业化闭环。 2需求端,Anthropic与OpenAI在订阅与计费结构上均做出调整,整体趋势指向将付费颗粒度从订阅/席位制向实际消耗量迁移,以更好适配Agent场景下用量波动较大的特征。 国内厂商动态 通义(阿里巴巴):本周通义密集发布产品。Qwen 3.6 Plus作为新一代基座模型,原生支持多模态理解与推理,编程能力已接近Claude系列水平,发布当日平台日调用量突破1.4万亿Token,刷新OpenRuter单日单模型调用纪录;Qwen3.5-Omni定位为全模态大模型,在多项多模态评测中超越Gemini-3.1 Pro;Wan2.7-Image将文生图、图生图、指令编辑等能力整合至统一模型框架,尝试用单一模型覆盖图像生成的全链路场景。综合来看,通义在模型层的产品节奏和生态拉动能力在国内头部厂商中处于较领先位置。 智谱:发布首个多模态Coding基座模型GLM-5V-Turbo,能够原生处理图片、视频、文本等多模态输入,在长程规划、复杂编程和动作执行方面具有优势,深度适配Agent工作流。发布2025年度业绩公告,全年实现收入7.24亿元(同比+131.9%),其中云端部署收入1.90亿元(同比+292.6%),本地化部署收入5.34亿元(同比+102.3%);用户生态方面,编程、智能体及企业级大模型服务已覆盖全球218个国家和地区,MaaS平台注册用户突破400万,付费开发者(Coding Plan)达24.2万,中国前十大互联网公司中已有9家深度集成GLM系列模型,3月推出的Claw Plan上线2天订阅用户破10万、上线20天订阅用户破40万;价格方面,公司于2026年2月主动上调Coding Plan价格30%并取消首购优惠,MaaS平台API调用定价较2025年底提升83%,市场仍呈现供不应求态势,量价齐升趋势显现。 MiniMax与Kimi(月之暗面):两家本周均未有重要产品发布。 国外厂商动态 1 Anthropic:自4月4日起调整订阅政策,第三方工具调用权限从订阅中剥离,用户需单独购买额度包或使用APIKey;因代码意外泄露,曝光了包括24小时自主代理KAIROS和AI电子宠物BUDDY在内的多项未发布功能,泄露代码显示其技术栈融合了Prompt Engineering、Context Engineering和Harness Engineering三层范式,Anthropic正从模型能力提供商向端到端Agent平台方向持续探索。 2 OpenAI:完成$1,220亿最新融资,投后估值达$8,520亿,并首次从个人投资者处筹集资金。该估值水平已接近部分全球头部科技公司市值,一定程度上反映出资本市场对“AGI平台”叙事的认可。产品端,Codex更新定价策略,新增按用量计费并下调团队年费,与Anthropic的调整方向趋同。 3 Google:Gemma 4开源家族覆盖E2B、E4B、26BMoE和31BDense四种规格,其中31B模型在Arena AI排行榜排名第3、26B模型排名第6,超越了20倍于其大小的模型;Veo 3.1 Lite以$0.05/秒(720p)的价格切入视频生成市场,仅为标准版的1/8;Google本周还推出了Gemini Flex/Priority推理分层,Flex API定价为标准API的50%,Priority API则上浮75–100%,为不同场景提供成本与延迟之间的显性权衡。 风险提示:技术迭代不及预期;行业价格战加剧;AI监管政策趋严;头部估值回调;Agent产品合规风险
|
|