>> 长江证券-软件与服务行业AI产业跟踪:GPT-5.2发布,关注大模型迭代进展-251216
| 上传日期: |
2025/12/16 |
大小: |
585KB |
| 格式: |
pdf 共5页 |
来源: |
长江证券 |
| 评级: |
看好 |
作者: |
宗建树,陈耀文 |
| 下载权限: |
此报告为加密报告 |
|
|
事件描述 当地时间12月11日,OpenAI正式发布新一代大模型GPT-5.2,主打通用智能、编码能力和长上下文任务处理,作为近期连续版本更新中的又一项核心升级。 事件评论 GPT-5.2性能持续提升,在众多基准测试中都刷新了行业水平。相较于GPT-5.1,GPT5.2在通用智能、超长文本理解、Agent工具调用以及视觉能力上均有一定提升。在SWEBench Pro、LMArena代码竞技场、ARC-AGI-2、GDPval等基准测试中均取得了靠前成绩。其中,在评估涵盖44个职业的知识型工作任务的GDPval测试中,GPT?5.2 Thinking有70.9%的对比结果优于或持平于顶尖行业专业人士,这些任务包括制作销售演示文稿、会计电子表格、制造流程图或短视频等,创下了新的SOTA,并且是历史第一个表现超过人类专家水平的模型。此外,其速度比专家专业人士还要快11倍,成本还低于1%。这或表明OpenAI在大模型性能方面仍具备一定领先优势。 定价与产品结构全面更新,OpenAI意欲“创造更大的经济价值”。OpenAI给出的官方文档明确指出,GPT-5.2的设计初衷在于“创造更大的经济价值”。在此次更新中,GPT-5.2被拆分为Instant、Thinking、Pro三个版本,Instant面向快速查询类任务,Thinking适用于长链条推理,Pro支持数学、编程及跨步骤复杂项目处理。同时,API价格也进行了一定调整,输入费用为每百万tokens 1.75美元,输出费用为每百万tokens 14美元,缓存输入部分可享90%的折扣。OpenAI开始明确把重心放在“经济价值”与“生产秩序”上,或一定程度的说明目前模型的货币化正成为大模型厂商关注的重点。 性能差异持续缩小,大模型竞赛或将提速。由于竞争对手谷歌发布的Gemini 3刷新多项行业测试榜单,OpenAI近期在内部启动“红色代码”,暂停部分非核心项目并调整研发资源,以加快产品迭代。同时,公司CEO奥尔特曼宣布,近期会给用户们带来一些“小小的圣诞礼物”。我们认为GPT-5.2或只是其近期加速开发的部分成果,后续仍将有新品持续发布。这或将预示着头部大模型厂商之间的大模型竞赛已进入白热化阶段,后续模型迭代有望持续加速。 GPT-5.2正式发布,关注大模型货币化进展。此次,OpenAI发布“迄今为止功能最强大的专业知识工作模型系列”——GPT-5.2,在提升性能的同时,将重心逐步转移至其模型货币化,或将加速大模型的商业化落地。建议关注:1)国内大模型厂商;2)国内大型云厂商;3)垂类场景Agent厂商;4)国产算力产业链。 风险提示 1、AI技术发展不及预期; 2、下游应用需求不及预期。
|
|