>> 国投证券-计算机行业周报:国产大模型加速迭代,基模和后训练兼顾-260810
| 上传日期: |
2026/8/10 |
大小: |
703KB |
| 格式: |
pdf 共8页 |
来源: |
国投证券 |
| 评级: |
领先大市-A |
作者: |
赵阳,夏瀛韬,杨楠 |
| 行业名称: |
计算机 |
| 下载权限: |
无限制-登录即可下载 |
|
|
DeepSeel-V4-Flash-0731正式发布,性价比突出 2026年7月31日,DeepSeek-V4-Flash迎来了一次更新,正式版API现已上线公测。根据官方文档显示,DS-V4-Flash正式版的各项测试成绩均大幅优于之前的V4-Pro-Preview版本,新版本经过大量后训练工作,Agent能力大幅增强,指令遵循能力大幅增强。具体而言,在综合的智能体评测中,DeepSeek-V4-Flash在Agent Last Exam和Automation Bench Public上分别取得25.2和25.1;在全栈开发基准DSBench-FullStack与难度更高的DSBench-Hard上,得分则达到68.7和59.6。 性价比突出,伴随用户需求增长,模型API将迎来提价。 DeepSeek-V4-Flash在仅用284B的参数量下,在官方的一系列测试集上,接近Claude-Opus-4.8的性能水平,价格较同水平模型具备显著优势。对比来看,DS-V4-Flash/Kimi K3/GLM 5.2的百万Token输入(缓存命中)价格为0.02元/2元/2元,输入(缓存未命中)价格为1元/20元/8元,输出价格为2元/100元/28元。DS-V4-Flash的价格在国产模型中具备显著优势。然而,伴随用户使用需求的快速提升,公司在官网公布,计划近期整体上调DeepSeek API服务的定价,预计涨幅较大,请用户合理安排使用。 阿里Qwen-3.8-Max发布,基模参数量达到2.4T 2026年8月3日,阿里正式发布Qwen3.8-Max,Qwen 3.8-Max基于Qwen 3.5的架构基础构建,参数规模扩展至2.4万亿,激活参数95B,支持100万上下文Tokens,在编程、办公、科研以及长周期任务等方面实现了全面提升。全球开发者都可通过千问AI平台获得Qwen3.8的API服务:国内每百万Tokens输入12元、输出36元,隐式缓存命中1.5元;海外每百万Tokens输入2美元、输出6美元,隐式缓存命中0.25美元。 从功能任务来看,Qwen 3.8-Max能够同时实现编程、办公、长周期复杂任务等多种功能。在编程场景,Qwen 3.8-Max通过连续独立工作约五天(125小时),实现研究论文的复现。在办公场景,Qwen3.8-Max能够交付多种生产级成果,如企业合规律师、结构工程师、体育数据分析师等工作。在长程复杂任务上,Qwen3.8-Max独立完成了一款GCD/RSA密码硬件加速器的设计。在没有参考设计、没有人类干预的条件下,独立完成了从算法架构、RTL代码到多轮优化的全过程。单次不间断运行中,历经约500轮交互、71次评估、13个关键里程碑,把设计从首个跑通的8,298门一路优化到678门。 建议关注:国产超节点、算力租赁、AI应用、国产模型等机会。 风险提示:技术迭代不及预期;市场需求不及预期等
|
|