>> 国盛证券-小米集团-W(01810.HK)推出极速模型、打造MiMoCode持久记忆-260614
| 上传日期: |
2026/6/14 |
大小: |
1024KB |
| 格式: |
pdf 共5页 |
来源: |
国盛证券 |
| 评级: |
-- |
作者: |
夏君 |
| 下载权限: |
无限制-登录即可下载 |
|
|
事件:6月9日,小米集团发布Xiaomi MiMo-V2.5-Pro-UltraSpeed。该模型是由MiMo团队和TileRT联合研发,首次在万亿参数的旗舰模型上实现每秒输出速度超1000 tokens。相较于MiMo-V2.5-Pro,UltraSpeed的定价是其三倍,而输出速度得到约10倍的提升。 1000tps不仅是速度的体现,更是对AI应用的底层颠覆。高并发推理使模型得以并行执行多条路径验证,更快的速度衍生出思考的深度,提升输出质量;同时打破编程Agent交互的效率瓶颈,并具备接入高频交易、实时风控等毫秒级决策闭环的条件,在医疗影像等关键场景中压缩临床决策时间。我们认为,推理效率的提升不仅是模型能力的升级,更是推动AI从辅助工具向核心基础设施演进、打开各类场景商业化空间的重要催化剂。 速度的背后,是模型与系统的极致Codesign。模型侧,针对通用硬件的带宽瓶颈,对MoEExpert进行FP4量化,在维持模型能力的基础上缩减模型体积并减少访存开销;同时采用DFlash块级masked并行预测方法,提升单次验证的Token接受长度。系统侧,TileRT通过引入常驻内核引擎和异构流水线协作,从底层避免了算子边界的执行间隙。在标准8卡通用GPU节点上,1T参数模型可实现每秒1000 tokens的输出速度。 MiMoCode开源强化生态,记忆系统与框架协同提升开发者粘性。MiMoCode基于OpenCode开发,并以MIT协议开源,通过独立subagent驱动的持久记忆系统与专属Harness+Compose模式,实现模型能力与Agent框架深度协同的同时,系统性解决长程遗忘并支持全流程开发。MiMoCode还内置/dream命令,每7天由独立Agent自动执行历史记忆的合并、去重、验证与压缩,将分散信息收敛为全局知识库并在后续会话中调用,带来“越用越顺手”的个性化使用体验。在面向编程场景的SWEBench和Terminal Bench的测试中,在使用相同MiMo模型的条件下,MiMoCode表现优于Claude Code。 重申“买入”评级。我们看好小米集团的AI探索、以及对人车家全生态的赋能潜力。我们预计小米集团2026-2028年收入为4731/5393/ 6057亿元,non-GAAP归母净利约293/351/407亿元。我们基于公司消费电子主业20x 2027e P/E,汽车及AI创新业务2.5x 2027e P/S,给予小米集团目标价51港币,重申买入”评级。 风险提示:手机竞争超预期,存储成本上升超预期,IoT进展不及预期,智能车竞争超预期,模型商业化不及预期。
|
|