发布日期:2025年2月1日 / 更新日期:2025年2月1日 – 作者: Konrad Wolfenstein
更智能:o3-mini 和 o3-mini-high 现已支持 ChatPGT 和 API 应用
OpenAI o3-mini:面向复杂思维的低成本人工智能开发的一次质的飞跃
随着 OpenAI o3-mini 的发布,人工智能领域又迎来了一个里程碑。这款先进的模型现已集成到 ChatGPT 中,并可通过 API 使用,代表了 OpenAI 推理模型家族中最新、最具成本效益的进步。o3-mini 将于 2024 年 12 月正式发布,它重新定义了小型模型的能力,并在科学、技术、工程和数学 (STEM) 领域展现出卓越的性能。与前代产品 OpenAI o1-mini 相比,它不仅性能卓越,而且成本更低、延迟更低,因此脱颖而出。.
OpenAI o3-mini 标志着范式转变,它是首个原生支持开发者期待已久的功能(例如函数调用、结构化输出和开发者消息)的小型推理模型。这意味着它从一开始就被设计用于生产环境。与之前的 o1-mini 和 o1-preview 一样,o3-mini 也支持流式传输,从而实现灵活动态的交互。开发者还可以选择三种推理强度级别——低、中、高。这种灵活性使得模型能够适应不同的使用场景:对于复杂的挑战,可以增强推理过程;而对于时间紧迫的任务,则侧重于速度和低延迟。.
重要提示:o3-mini 不适用于涉及视觉分析的任务。对于此类应用,开发者应继续使用 OpenAI o1。o3-mini 将在聊天补全 API、助手 API 和批量 API 中逐步推出,初期访问权限将仅限于 3-5 级的特定 API 用户。.
与此相关:
ChatGPT 用户可享受增强功能带来的益处
对于终端用户来说,也有好消息:ChatGPT Plus、Team 和 Pro 用户现在可以使用 o3-mini,而企业客户将于 2 月份获得访问权限。o3-mini 取代了 o1-mini,提供更高的速率限制和更低的延迟。这使其成为编程、STEM(科学、技术、工程和数学)以及逻辑问题解决等任务的理想选择。作为此次升级的一部分,Plus 和 Team 用户的消息限制从每天 50 条(使用 o1-mini)增加到每天 150 条(使用 o3-mini),提升至原来的三倍。.
此外,o3-mini 现在已集成搜索功能,可提供来自相关来源的最新答案。这代表了一个早期原型,OpenAI 正在努力将搜索功能集成到所有推理模型中。这种集成使模型能够访问更广泛的信息,从而生成更全面、更及时的答案。.
免费供所有人使用
一项特别值得关注的新功能是,免费版 ChatGPT 用户现在可以使用 o3-mini 模型。他们可以在消息编辑器中选择“推理”选项或重新生成回复来试用该模型。这是 ChatGPT 首次向免费用户提供推理模型,也体现了 OpenAI 致力于让所有人都能使用高质量 AI 的承诺。.
从今天(2025年1月31日)起,OpenAI o3-mini免费版的用户也可以通过在消息编辑器中选择“推理”或重新生成回复来体验该功能。这是ChatGPT首次向免费用户开放推理模型。
虽然 OpenAI o1 仍然是通用知识领域的综合模型,但 o3-mini 定位为针对需要高精度和高速度的技术领域的专业替代方案。在 ChatGPT 中,o3-mini 默认使用中等处理能力,以实现速度和准确性的平衡。付费用户还可以在模型选择中选择 o3-mini-high,使用一个更加智能的版本,该版本响应时间略长。专业版用户可以无限制地使用 o3-mini 和 o3-mini-high。.
STEM 任务的性能和优化
与前代产品 o1 一样,o3-mini 也专门针对 STEM(科学、技术、工程和数学)任务进行了优化。在中等推理难度下,o3-mini 在数学、编程和科学方面的表现与 o1 相同,但给出答案的速度却显著更快。专家评测表明,o3-mini 不仅能提供更准确、更清晰的答案,而且展现出比 o1-mini 更强的推理能力。测试人员在 56% 的情况下更倾向于 o3-mini 的答案,并且在具有挑战性的实际问题中,o3-mini 的严重错误率显著降低了 39%。在中等推理难度下,o3-mini 在一些最具挑战性的推理能力和智力评估测试(包括 AIME 和 GPQA)中的表现与 o1 相同。这凸显了该模型处理复杂问题的能力。.
各个领域的详细绩效数据
数学竞赛(AIME 2024):在数学竞赛中,o3-mini 在低认知负荷下即可达到与 o1-mini 相当的性能。在中等认知负荷下,其性能已与 o1 持平;而在高认知负荷下,其性能则超越了 o1-mini 和 o1。这些结果凸显了 o3-mini 在认知负荷不断增加的情况下解决数学问题的能力。.
博士级问题(GPQA Diamond):在科学领域,尤其是在生物学、化学和物理学博士阶段,o3-mini 在认知负荷较低的情况下优于 o1-mini。在认知负荷较高的情况下,它甚至可以达到 o1 的水平。这表明 o3-mini 能够回答和理解即使是具有挑战性的科学问题。.
数学研究(FrontierMath):在数学研究领域,o3-mini 在 FrontierMath 的高计算量测试中表现优于其前身。使用 Python 工具时,o3-mini 首次尝试即可解决超过 32% 的问题,其中包括超过 28% 的 T3 级难题。这充分证明了该模型解决复杂数学问题和开发创新解决方案的能力。.
竞技编程(Codeforces):在 Codeforces 级别的竞技编程中,随着计算量的增加,o3-mini 的 Elo 分数持续提升。即使在中等计算量下,它的性能也与 o1 相当;而在高计算量下,它则显著超越了 o1 和 o1-mini。这些结果表明该模型具有令人印象深刻的代码理解和生成能力。.
软件工程(SWE-bench 验证):在软件开发领域,o3-mini 是 OpenAI 迄今为止通过 SWE-bench 验证的最强模型。这凸显了该模型在实际软件开发场景中的出色性能。.
常识:数据分析显示,o3-mini 在各个常识领域都比 o1-mini 具有明显的优势。这表明 o3-mini 对世界的理解更加全面。.
速度和效率
除了卓越的性能外,o3-mini 的速度和效率也令人印象深刻。在 A/B 测试中,o3-mini 的速度比 o1-mini 快 24%。其平均响应时间为 7.7 秒,而 o1-mini 的平均响应时间为 10.16 秒。响应时间的显著提升使 o3-mini 成为对速度要求极高的应用的理想之选。.
与此相关:
安全与对齐
OpenAI 非常重视其模型的安全性。为了确保 o3-mini 生成安全的响应,我们采用了经过深思熟虑的对齐技术。安全评估表明,在具有挑战性的安全和越狱场景测试中,o3-mini 的表现优于 GPT-4o。这凸显了 OpenAI 致力于开发安全可靠的 AI 系统的决心。.
o3-mini:面向更智能未来的先进人工智能
o3-mini 的发布彰显了 OpenAI 的使命:开发经济高效的人工智能,并进一步普及高质量智能。凭借其在 STEM(科学、技术、工程和数学)领域的专长、低成本和卓越的效率,o3-mini 树立了新的标杆,并为人工智能的未来创新铺平了道路。该模型生动地展现了人工智能如何变得日益强大和易用,并有望在诸多方面改善我们的生活。正如人们常说的,o3-mini 的发布标志着我们朝着人工智能融入日常生活这一未来迈出了重要一步。.
像o3-mini这样的模型开发是一个持续的过程。算法的不断改进、神经网络的优化以及规模日益庞大的数据集的收集,将在未来催生出更强大、更高效的人工智能系统。这些进步不仅有望进一步推动技术发展,还将对我们生活的诸多领域产生积极影响。从医疗、教育到环境——其应用前景几乎是无限的。.
OpenAI 的一位高级开发人员表示,“o3-mini 的发布是我们在利用人工智能解决人类最复杂问题道路上迈出的又一步”。正是这一愿景驱动着 OpenAI 的工作,引领我们走向人工智能成为改善世界强大工具的未来。他补充道:“我们认为 o3-mini 的开发是一个重要的基石,它将使我们能够在不牺牲人工智能功能的前提下,让更多用户能够使用人工智能。”.
总而言之,OpenAI o3-mini 不仅是一项技术突破,也证明了先进技术如何能够改变世界,塑造一个人工智能融入我们生活的未来。正如一位人工智能专家所说,“此类模型的持续发展”“体现了人类的创新精神以及对知识和进步的不懈追求”。.
与此相关:
我们为您提供以下服务:咨询、规划、实施、项目管理
☑️ 我们的业务语言是英语或德语。
☑️ 新增:用您的母语进行通信!
我和我的团队很乐意为您提供私人顾问服务。.
您可以通过填写此处的联系表格联系我[email protected]:,或者直接致电+49 7348 4088 965。我的邮箱地址是
我期待着我们的合作项目。.



