>> 长江证券-软件与服务行业AI产业跟踪:OpenAI发布GPT-5-Codex,持续看好AI Agent商业化落地进展-250918
| 上传日期: |
2025/9/19 |
大小: |
628KB |
| 格式: |
pdf 共5页 |
来源: |
长江证券 |
| 评级: |
看好 |
作者: |
宗建树 |
| 下载权限: |
此报告为加密报告 |
|
|
事件描述 2025年9月16日,OpenAI推出新模型GPT-5-Codex,是专为智能体编程(Agentic Coding)设计的版本。定价包含在现有的ChatGPT订阅计划中,当前可在Codex CLI、IDE扩展、Web、移动设备以及Github中的代码审查中使用,预计很快通过API提供。 事件评论 基于大规模真实工程任务训练,胜任实现全方位编程任务,可引导性更强、指令遵循更加精准、代码生成质量更高。SWE-bench Verified (n=500)得分74.5%,(GPT-5为72.8%),提升稳健;代码重构任务中提升显著,准确率从33.9%跃升至51.3%,任务中模型需进行大型代码库的结构改造,说明上下文联动、理解依赖关系或为训练重点。模型在大型成熟代码库的维护升级方面展现优势,曾连续独立工作超过7个小时并成功交付。此外,模型具备多模态能力,在前端任务表现同样优秀。 核心竞争力或在于模型自适应思考机制带来的高效token利用。GPT-5-Codex根据任务复杂度自动分配计算资源,(1)在最简单的前10%任务中,GPT-5-Codex比GPT-5减少93.7%的计算量;(2)在最复杂的后10%任务中,Codex选择比GPT-5增加102.2%的token量进行推理、编辑、测试和迭代。 代码审查能力增强,能力边界与落地场景拓展。(1)不正确评论显著降低:从13.7%降至4.4%。(2)高影响力评论显著增加:从39.4%提升到52.4%;(3)聚焦关键重点:平均每个PR(拉取请求)提出的评论数从1.32降至0.93。我们认为,模型实现支持全生命周期编程及其高质量交付,有望极大提升开发效率,并使落地场景更加多元化,包括前端开发设计自动化、企业级大规模代码重构等。 模型成为能真正交付的“工程智能体”,未来软件开发范式或将从“人写代码+工具辅助”升级为“AI完成大部分代码+人类监督和设计架构”。GPT-5-Codex本质是开发者的“虚拟编程伙伴”,而非简单代码补全,旨在解决传统编程过程中复杂任务处理、多环境切换、代码审查等耗费人力的痛点。Agent从一种产品功能变成了对开发流程的嵌入,开发者只需简单描述需求,即可获得符合预期的成果,无需再为编码风格或代码整洁度编写冗长的指令。此外,伴随Codex生态系统与工具全面升级,用户体验有望进一步改善,用户粘性提升,加快商业化落地。 关注编程智能体后续发布。当前Agent投资核心逻辑强化,海外AI货币化开启,作为AGI的核心场景,国内外编程赛道模型迭代与商业化落地均在加速。伴随模型能力持续提升、成本进一步下降,Coding等垂直场景的Agent落地周期有望提前,看好Agent商业化元年及相关投资机遇。建议关注:1)AIInfra:伴随AI应用落地,AIInfra有望核心收益,重点推荐阿里巴巴;2)AIAgent相关厂商;3)中国推理算力产业链;4)CSP厂商方面关注推理需求带来的推动;5)IDC,重点关注与阿里、腾讯等大厂合作的IDC。 风险提示 1、AI技术发展不及预期; 2、下游应用需求不及预期。
|
|