跳到正文
Daily Edition · AI industry record
Live desk ●
发布综合报道2 分钟阅读更新于作者:AI Tools Daily

Google 发布 Gemini 2.5 Pro:首个思考型旗舰模型登顶多项基准

Google 于 2025 年 3 月发布 Gemini 2.5 Pro,内置推理能力,在多项基准上以明显优势领先。

Google 于 2025 年 3 月发布 Gemini 2.5 Pro(首发为 Experimental 版本),这是其首个思考型(thinking)旗舰模型——在回应前先进行推理,发布时在多项主流基准上以明显优势领先,尤以推理与代码能力著称。

Gemini 2.5 Pro 支持超长上下文窗口,能处理大规模文档、代码库和多媒体输入。在 Reddit 等开发者社区,其 3 月版本被广泛评价为“突破性”进步,帮助 Google 在与 OpenAI、Anthropic 的竞争中重新挤回第一梯队。

从追赶到反超:一年翻盘的转折点

回到 2023-2024,Google 还处在 Bard 仓促应战、Gemini 1.x 口碑平平的被动局面;2.5 Pro 是叙事翻转的支点——首次在推理与代码两个最硬的维度上同时站上领先位置。支撑它的是 Google 独有的垂直整合:自研 TPU 算力、DeepMind 研究管线与搜索分发链条在同一屋檐下。

思考型模型的竞赛升级

2.5 Pro 的“先推理后回答”延续 o1 开创的范式(参见本站报道),但把它带入了百万 token 级长上下文场景:整个代码库、成百页文档可以一次性入模型再深度推理。几个月后的 I/O 大会上,Deep Think 模式、AI Mode 搜索相继登场,思考型能力成为 Google 全家族产品的统一底座。

后续时间线

2.5 系列此后持续迭代并全面上线 Gemini 应用与 Workspace;8 月 Nano Banana 图像模型出圈把 Gemini 应用送上美国 App Store 榜首;11 月 Gemini 3 接棒;到 2025 年底,苹果确认新 Siri 将基于定制 Gemini(参见本站报道)——从基准领先到入口级商单,2.5 Pro 开启的势能一路延续。

本站解读

2.5 Pro 的样本意义在于:大公司的组织惯性可以被技术纵深对冲。Google 靠自研芯片降低推理成本、靠研究储备补齐推理能力、靠存量入口完成分发,三张牌打齐后,“大船难掉头”的质疑不攻自破。对观察者的启示是:在基础模型竞赛中,永远不要用单代模型的表现给巨头定性。

本文综合自官方公告及公开报道,原始来源见文末链接。

本文提到的工具