>> 国信证券(香港)-市场资讯晨报:OpenAI发布新AI模型o1,推理能力大幅提升-240913
| 上传日期: |
2024/9/13 |
大小: |
2502KB |
| 格式: |
pdf 共13页 |
来源: |
国信证券(香港) |
| 评级: |
-- |
作者: |
郑宇飞 |
| 下载权限: |
无限制-登录即可下载 |
|
|
全球投资焦点 美国股市周四上涨,主要受到投资者对新公布的通胀和就业数据的乐观预期,以及对美联储下周降息25个基点的预期所推动。与此同时,疫苗制造商Moderna的股价因下调收入预期而大幅下挫。 1.美国股市在周四上涨,主要受到投资者对新发布的通胀和劳动力数据的分析,以及对下周降息预期的影响。标准普尔500指数上涨0.7%,连续第四个交易日收盘上涨;纳斯达克综合指数上涨约1%,同样实现四连涨,主要得益于科技股的强劲表现;道琼斯工业平均指数上涨近0.6%。 2.股市开盘时变化不大,但随着科技股的回暖,市场逐渐走高。本周公布的经济数据增强了市场对美联储下周降息25个基点的预期,而非50个基点。具体来看,8月份的生产者价格指数(PPI)环比上涨0.2%,符合市场预期,年率上涨1.7%。与此同时,最新的就业数据表明,上周初请失业金人数达到230,000人,略高于预期,这进一步减少了降息幅度的不确定性。 3.在个股方面,疫苗制造商Moderna的股价下跌12%,因其下调了2025年的收入预期并计划削减研发预算。 OpenAI正在发布新AI模型o1,该模型具有人类般的推理能力,能够解决复杂的多步骤问题。虽然o1目前缺乏一些ChatGPT的实用功能,但它在推理任务上代表了AI能力的重大进步。预览版将向付费用户提供,使用体验与之前的模型有所不同。 1. OpenAI正在发布一种新的人工智能模型o1,在内部被称为"Strawberry"。该模型可以执行一些类似人类的推理任务,帮助OpenAI在竞争激烈的AI市场保持领先地位。 2. o1模型的主要特点包括: 在响应用户查询前,花费更多时间计算答案; 能够解决多步骤问题,包括复杂的数学和编码问题; 作为早期模型,缺少ChatGPT的许多实用功能,如浏览网页、上传文件等,但对于复杂推理任务来说是一个重大进步,代表了AI能力的新水平。 3. o1模型的预览版将于9月12日通过ChatGPT向付费用户提供。OpenAI表示即使有权限访问,用户每周也只能使用o1-preview 30条消息,o1-mini 50条消息。 4.使用o1模型的体验与ChatGPT有所不同。在响应用户提示前,新模型会暂停几秒钟,在后台考虑相关提示并总结最佳答案,这被称为"思路链"提示。 5. OpenAI一直致力于让AI系统执行多步骤操作。例如在2023年5月,他们发布了一篇关于提高AI解决数学问题能力的博客和研究论文。总的来说,o1模型标志着OpenAI在推理能力方面的重大进步。但它目前仍有局限性,OpenAI表示未来会继续改进和扩大使用范围。 OpenAI o1是一系列新的推理模型,主要特点包括: 1.在回答之前会进行深入思考。o1模型在回答用户提问之前,会先花费更多时间进行思考,就像人类思考解决问题的过程一样。它会产生一个长的内部思维链,通过奖励和惩罚来学会完善自己的思维过程,尝试不同的策略,并认识到错误。 2.在复杂推理任务上表现出色。OpenAI测试发现,o1模型在物理、化学、生物学等基准任务上的表现接近博士生水平。在数学和编程方面也有出色表现,在IMO资格考试中正确率达83%,在Codeforces比赛中排名89%。 3.代表了AI能力的新水平。OpenAI表示,对于复杂推理任务来说,o1模型的出现是一个重大进步,代表了人工智能能力的崭新水平。因此他们将计数器重置为1,并将该系列命名为OpenAI o1。 4.使用成本较高。o1模型的使用成本比GPT-4o高出3-4倍。在API中,o1-preview每100万个输入token收费15美元,每100万个输出token收费60美元。总的来说,OpenAI o1模型通过深入思考和强化学习,在复杂推理任务上展现出了前所未有的能力,标志着AI技术的重大突破。但目前使用成本较高,限制了普及。 OpenAI o1模型在算法和性能方面进行了显著提升,主要体现在以下几个方面: 1.强化学习与思维链。o1模型采用了一种全新的训练方法,通过强化学习来改进其推理能力。这种方法允许模型在回答问题之前进行深入思考,生成长的内部思维链,从而更有效地识别和纠正错误。这与以往的模型主要依赖于模仿数据集模式的训练方式有根本性的区别。 2.复杂推理能力的提升。o1在处理复杂的数学、编程和科学问题上表现出色。在国际数学奥林匹克(IMO)资格考试中,o1模型的正确率达到了83%,而GPT-4o仅为13%。该模型的推理能力已接近物理、化学和生物学领域的博士生水平,显示出其在专业领域的强大能力。 3.训练数据集的定制化。o1模型使用了专门为其量身定制的训练数据集,包含推理数据和科学文献。这种定制化的训练数据集使得模型能够更好地理解和解决特定领域的问题,提升了其在复杂任务中的表现。 4.成本与性能的权衡。尽管o1模型在推理能力上有显著提升,但其使用成本也相应增加,至少是GPT-4o的三倍。为了应对高昂的计算成本,OpenAI还推出了o1-mini版本,旨在为开发者提供更经济的解决方案。 全球最大的科技公司,如谷歌和苹果,正面
|
|