OpenAI正式发布了新一代推理模型o1系列,包括o1-preview和o1-mini两个版本。该系列模型在推理能力上实现显著突破,能够像人类一样进行深度思考,在数学、编程、科学等复杂任务上表现优异,标志着AI模型从快速响应向深度推理的转变。
o1系列通过强化学习训练,在生成回答前会进行内部思考,生成隐藏的思维链。在多项基准测试中,o1-preview在数学、代码生成等任务上超越了GPT-4o,而o1-mini则在保持较高推理能力的同时,实现了更低的成本和更快的响应速度,适合需要推理但非广泛知识的场景。
目前,o1系列已面向ChatGPT Plus和Team用户开放,API版本也已上线。OpenAI表示,未来将不断优化该系列模型,并计划为免费用户提供o1-mini的访问权限。