OpenAI近日正式发布新一代推理模型o3,该模型在数学、编程和科学推理等复杂任务上表现出色,性能较前代o1模型有显著提升。o3模型在ARC-AGI基准测试中得分高达87.5%,远超o1模型的32%,并在Codeforces编程竞赛中达到2724的Elo评分,超越多数人类程序员。

OpenAI表示,o3模型通过更深入的推理和更长的思考时间,能够处理更具挑战性的问题,但这也意味着更高的计算成本和响应延迟。目前,o3模型已开放给安全研究人员进行测试,普通用户可申请加入等待名单,预计将在未来几个月内逐步向公众开放。