OpenAI于4月16日发布新一代推理模型o3和o4-mini,并已全面登陆ChatGPT与API。o3作为旗舰推理模型,在数学、编程、科学问答等基准测试中刷新纪录,其最显著的特点是能“思考”图像——通过内部视觉推理实现图表解读、手写笔记识别等能力,并能将图像作为推理上下文的一部分。
o4-mini则是一款轻量级模型,在保持高推理能力的同时,将成本降低了90%。OpenAI还推出了开源工具Codex,支持在终端中执行任务,并计划未来开源具备视觉能力的推理模型。
此外,GPT-5将在未来几个月内发布,届时将整合o系列与GPT系列的技术优势,并支持多模态能力。OpenAI强调,o3和o4-mini已具备自主工具调用能力,可更高效地完成复杂任务。