中国大模型在数学推理领域取得里程碑式突破。近日,某国产大模型在国际数学奥林匹克竞赛(IMO)官方测试中,首次获得金牌水平认证,标志着中国AI在复杂数学问题求解能力上达到国际顶尖水准。
该模型在IMO 2024年真题测试中,成功解答了全部6道题目中的5道,得分率超过85%,达到金牌分数线。此前,仅有OpenAI的o1模型获得过类似认证。这一成果证明中国大模型在符号推理、逻辑推导等核心能力上已跻身全球第一梯队。
专家指出,数学推理能力是衡量大模型智能水平的关键指标。此次突破不仅展示了中国AI在基础科研领域的进步,也为数学、物理等学科的科学计算和自动推理应用奠定了基础。