>> 华创证券-传媒行业重大事项点评:Kimi K3推动开源模型迈入3T级别,持续看好国产模型发展-260726
| 上传日期: |
2026/7/26 |
大小: |
710KB |
| 格式: |
pdf 共5页 |
来源: |
华创证券 |
| 评级: |
推荐 |
作者: |
姚蕾,程泽惠 |
| 行业名称: |
传媒 |
| 下载权限: |
此报告为加密报告 |
|
|
事项: 7月17日,月之暗面发布Kimi K3模型。截至7月22日,Kimi K3在ArtificialAnalysis榜单排名第3,在Code Arena榜单排名第1。 评论: 全球首个开源3T级别模型,性能比肩头部闭源模型。Kimi K3参数量达2.8T,采用Stable LatentMoE框架,可以在896个专家中高效激活16个;原生支持视觉理解,并拥有100万token上下文窗口,是全球首个开源的3T级别模型,面向长程编程、知识工作和推理等前沿智能场景而设计。截至7月22日,KimiK3在Artificial Analysis Intelligence Index以57分位列第三,仅次于ClaudeFable 5及GPT-5.6 Sol(max),领先于上一代旗舰闭源模型Claude Opus 4.8(max)、GPT-5.5(xhigh);在Frontend Code Arena榜单中以1679分超过Fable5、GPT-5.6 Sol等闭源模型位居榜首,是开源模型首次在该榜单上超越闭源模型登顶。 底层原创架构创新推动性能跃升、支撑核心战略方向。Kimi K2系列模型发布于2025年7月,2025年11月推出K2 Thinking,26年1月推出K2.5,26年4月推出K2.6,26年6月推出K2.7 Code编程模型。根据Kimi公司,K3的性能跃升主要来自三大底层自研技术:1)Moon Clip:全新二阶优化器,由Kimi首次应用于大模型训练,在全球可用训练数据基本见底的情况下,能让20T训练数据跑出40T的训练效果,同等性能下训练成本、算力功耗直接减半。2)Kimi Linear Tension:自研线性注意力机制,解决传统线性注意力处理超长任务时性能衰减的痛点,让上下文窗口扩大十倍,训练成本仅同步扩大十倍。3)Attention Residuals:注意力残差,优化模型多层网络间信息传递、复用逻辑,让2.8T超大参数模型既能稳定完成训练,又能让推理效率同步提升25%。三大底层技术分别支撑Kimi长期深耕的三大核心方向:Long Context(长上下文)、Token Efficiency(Token效率)、Agent Swarm(智能体集群)。 聚焦高价值生产力场景,性能跃升带来需求爆发及强定价权。K3官方案例包括编程、数字内容创作(3D模拟、游戏开发等)、芯片设计、知识工作(研究和可视化、小组件和看板、视频剪辑)等,Kimi公司表示将长期聚焦编程、金融、法律、科学研究等高难度生产力场景。Kimi的C端收费模式主要为会员订阅,分为Andante、Moderato、Allegretto、Allegro四个档位,定价分别为每月49元、99元、199元、699元。B端接入方式包括企业版(定价599美元/年/席位)或通过API调用(每百万Token输入/输出3/15美元),较K2.7 Code的0.95/4美元提升214%/278%,体现模型性能跃升带来的强定价权;相比Fable5(每百万Token输入/输出10/50美元)、GPT-5.6 sol(每百万Token输入/输出5/30美元)有较强价格竞争力。7月19日,Kimi发布《关于算力紧缺与会员暂停开放的说明》,决定暂停C端新用户订阅,将已有算力投入服务已订阅用户并全速推进算力扩容,体现模型性能跃升带来的需求爆发式增长。 投资建议:从GLM-5.2到Kimi K3,国产模型性能提升节奏超预期,具备全球前沿竞争能力,有望摆脱低价标签,通过高智价比竞争高价值场景。持续关注国内模型迭代节奏,包括DeepSeek-V4正式版、Qwen3.8、GLM-5.3、MiniMaxM3 pro等。我们持续看好AI产业发展,随着模型智能水平提升,并同步推进产品化、商业化上,在Coding、Working、AI for Science、AI原生娱乐等场景持续渗透。模型公司在组织灵活性及效率、架构及工程创新等领域具备优势,互联网大厂在资金实力、算力获取、用户及销售网络等方面具有优势,建议关注阿里巴巴-W、腾讯控股、智谱、MiniMax、快手-W。 风险提示:模型技术迭代不及预期、AI应用商业化不及预期、推理部署成本降低进展不及预期、行业竞争格局恶化、估值中枢下移等风险
|
|