OpenAI于4月17日正式发布了新一代推理模型o3和o4-mini,这是其首次将视觉感知能力直接集成到推理过程中。新模型不仅能够通过思维链进行深度推理,还能在推理时调用工具,如浏览网页、运行Python代码和处理图像,从而完成更复杂的多步骤任务。

o3和o4-mini在多个基准测试中表现优异,尤其在数学、编程和视觉推理任务上显著超越前代GPT-4o。OpenAI还同步推出了轻量级编码智能体Codex,基于o3模型优化,专为软件开发任务设计,支持在云端并行运行多个任务。

此次更新标志着OpenAI从单一模型向智能体生态的转型,o3系列被定位为“能够自主执行任务的智能体模型”,而不再局限于对话式问答。API同步开放,开发者可集成这些能力构建自动化工作流。