研报下载就选股票报告网
您好,欢迎来到股票分析报告网!登录   忘记密码   注册
>> 长江证券-软件与服务行业AI产业速递:Claude 4系列模型大幅提升自主编码能力,Agent走向下一程-250526
上传日期:   2025/5/27 大小:   559KB
格式:   pdf  共5页 来源:   长江证券
评级:   看好 作者:   宗建树
下载权限:   此报告为加密报告
事件描述
  美国时间5月23日,Anthropic正式发布Claude 4系列模型,包括Claude Opus 4和ClaudeSonnet 4两款混合模型。其中,Claude Opus 4是其发布的最高性能的编码模型,在复杂、长时间运行的任务和代理工作流上具有持续的性能。Claude Sonnet 4是Claude Sonnet 3.7的重大升级,提供卓越的编码和推理,并且增强了可控性,从来更好地实施控制,提供功能和实用性的优质组合。该系列模型显著提升了AI的工具能力,核心提升了模型对工具使用、并行工具执行和进行扩展思考的能力,并且减少了模型使用快捷方式或漏洞完成任务的行为。
  事件评论
  新一代模型专为编码和代理任务设计,可自主编码长达7h。公司模型类别一般可以分为Haiku(速度最快)、Sonnet(智能和速度取得平衡)和Opus(最智能),上一代公司最智能的Opus模型Claude Opus 3在美国时间2024年3月4日发布,已经长达一年未更新。本次重磅发布Claude Opus 4,该模型专为编码和代理任务设计,可自主编码完成人类需要长达6-7个小时才能完成的任务。在SWE-bench(软件工程任务的性能基准)其得分为72.5%,超越了OpenAICodex-1的72.1%、OpenAI o3的69.1%和Gemini2.5 Pro的63.2%;在Terminal-bench(代理任务)其得分为43.2%,明显高过OpenAIo3的30.2%和Gemini 2.5 Pro的25.3%。Claude Opus 4模型在编码、推理、多模态功能和代理任务方面均有明显的性能提升,推动模型工具能力进一步跃升。Claude Sonnet4模型在Sonnet 3.7业界领先的功能基础上进行了显著提升,解决了Sonnet 3.7的过度积极的问题,并且在SWE-bench上达到了72.7%的最高代码准确率。Opus 4突破了编码、研究、写作和科学发现的界限,而Sonnet 4为日常用例带来了前沿性能。定价与之前模型保持一致,Opus 4为$15/$75每百万Tokens(input/output),Sonnet 4为$3/$15。
  发布并全面开放Claude Code,Agent进入自主阶段。Claude 3.7可以自主工作约45min不失去连贯性,Claude 4可以突破数小时。Anthropiic认为人工智能代理应该擅长三种能力,并以此为依据指定发展规划:(1)情景智能:理解你和你组织的独特背景,并不断从经验中学习,获取情景记忆和组织记忆;(2)长期执行能力:无需持续管理的情况下可处理复杂、耗时数小时的任务;(3)真正的协作:智能自主,与明确的检查点相平衡。Claude系列模型的升级给代理任务提升了更多探索的可能性。
  多合作伙伴认可,Agent迈入新阶段。Cursor称其为最先进的编码技术,是复杂代码库理解的飞跃。Cognition称Opus 4擅长解决其他模型无法解决的复杂挑战,成功处理了以前模型错过的关键行动。GitHub宣布Claude Sonnet 4将作为支持GitHub Copilot中新编码代理的模型。Manus也强调了它在遵循复杂指令、清晰推理等方面的提升。伴随模型能力提升,Agent的适用场景有望不断扩张快速渗透,推荐关注AI coding板块的持续机遇,以及垂类场景下具有产品壁垒和数据壁垒的产品型厂商。
  风险提示
  1、AI技术发展不及预期;
  2、下游应用需求不及预期。
  
 
Copyright © 2005 - 2021 Nxny.com All Rights Reserved 备案号:蜀ICP备15031742号-1