OpenAI o4 - mini
发布时间: 2025-04-16
支持
200K tokens
推理大模型
2025-04-16
输入支持
输入支持
输入不支持
输入不支持
输入不支持
输出支持
输出不支持
输出不支持
输出不支持
输出不支持
o4 mini是OpenAI最新发布的推理大模型。
OpenAI o4-mini 是一款专注于快速、经济高效推理的小型化模型。尽管其规模较小,但它在数学、编码和视觉任务等领域展现出显著的性能。
该模型具备强大的推理能力,并能够有效地利用和组合ChatGPT内的各种工具,包括网络搜索、使用Python分析上传文件和数据、对视觉输入进行深度推理,甚至生成图像。o4-mini经过训练,能够判断何时以及如何使用这些工具来解决复杂问题,并生成详细且经过深思熟虑的答案。
在性能方面,o4-mini在多个基准测试中表现出色。例如,在AIME 2024和2025数学竞赛中,o4-mini是表现最佳的基准模型。当配合Python解释器使用时,o4-mini在AIME 2025上实现了99.5%的pass@1(8个一致性答案下达到100%的共识)。这体现了其有效利用工具的能力。专家评估指出,o4-mini不仅在数学、编码和视觉任务上表现优异,在非STEM任务以及数据科学等领域也超越了其前代模型o3-mini。同时,与前代推理模型相比,o4-mini在指令遵循、提供更有用和可验证的回复方面均有提升,交互时也表现得更为自然和对话化,能够更好地利用记忆和过往对话内容使回复更具个性化和相关性。
o4-mini在效率和成本方面也具有优势。由于其高效性,o4-mini支持比o3更高的使用限制,使其成为处理需要推理能力的高容量、高吞吐量任务的有力选择。在成本效益方面,o4-mini相较于o3-mini实现了提升,预计在多数实际应用场景中,o4-mini将比o3-mini更智能且更经济。
在安全性方面,OpenAI为o3和o4-mini重建了安全训练数据,增加了在生物风险、恶意软件生成和越狱等领域的拒绝提示。这使得o4-mini在内部拒绝基准测试中表现出色。同时,OpenAI还开发了系统级缓解措施来标记高风险领域的危险提示。根据评估结果,o4-mini在生物与化学、网络安全和AI自我改进三个追踪能力领域均低于“高”风险阈值。
用户可以通过多种途径访问o4-mini。ChatGPT Plus、Pro和Team用户可以在模型选择器中找到o4-mini和o4-mini-high,它们将替代此前的o3-mini和o3-mini-high。免费用户可以在提交查询前选择“Think”来体验o4-mini。开发者也可以通过Chat Completions API和Responses API使用o4-mini。
关注DataLearnerAI微信公众号,接受最新大模型资讯