OpenAI于9月13日发布了新一代推理模型o1系列,包括o1-preview和o1-mini。该系列模型通过强化学习训练,能在回答前进行深度思考,推理能力显著提升,在数学、编程等复杂任务上接近甚至超越人类专家。o1-preview在IOI 2024编程赛中排名前49%,而o1-mini作为轻量版,性价比更高,适合开发者和科研人员。
o1系列采用全新的“思维链”机制,能够像人类一样分解问题、尝试不同策略并自我纠错。在测试中,o1-preview在AIME数学竞赛中正确率达74.4%,远超GPT-4o的12%。不过,o1的响应速度较慢,且不支持网页浏览和文件上传。OpenAI强调,o1系列目前处于早期阶段,未来将持续改进。
此次发布标志着AI推理能力的重要突破,可能推动科学、编程等领域的应用变革。OpenAI计划逐步扩展o1系列功能,包括API访问和更多工具支持。