跳到正文
Daily Edition · AI industry record
Live desk ●
研究综合报道作者:AI Tools Daily

AI 首次拿下国际数学奥林匹克金牌:Google 与 OpenAI 双双达标

2025 年 7 月,Google DeepMind 的 Gemini Deep Think 与 OpenAI 的实验模型均在 IMO 上达到金牌水平,大模型首次与金牌得主比肩。

2025 年 7 月,在国际数学奥林匹克(IMO)上,Google DeepMind 的 Gemini Deep Think 完美解出六道题中的五道,拿下 35 分达到金牌标准;OpenAI 的实验推理模型也声称达到金牌水平。据 Nature 报道,这是大模型首次在 IMO 上与金牌得主同台竞技。

IMO 题目需要创造性的多步骤证明,长期被视为机器难以跨越的推理高地。两家都强调用的是通用模型而非专用解题器,展现了推理能力的泛化。

不过学界也提醒:评测方式与人类考生不完全可比。无论如何,AI 攻克 IMO 金牌是推理模型能力的一个象征性里程碑。

本文综合自官方公告及公开报道,原始来源见文末链接。

本文提到的工具