8月1日,谷歌正式推出Gemini 2.5 Deep Think新一代人工智能模型。该产品目前已在Gemini应用中面向Google AI Ultra订阅用户开放使用。性能测试数据显示,这款新模型在多个核心指标上表现优异,超越了OpenAI的o3和xAI的Grok-4等主流竞品。

据了解,谷歌在今年5月的Google I/O开发者大会上首次展示了Gemini 2.5 Pro的Deep Think模式。该模式采用创新的研究方法,能够在输出答案前进行多假设推理。此次发布的升级版本根据早期测试用户的反馈进行了全面优化,性能较初始版本有显著提升。
值得注意的是,该模型是谷歌此前在国际数学奥林匹克竞赛(IMO)中获得金牌的AI模型的改进版本。为了更适合日常应用场景,开发团队对其进行了运行速度优化,这使得其在2025年IMO基准测试中的表现调整为铜牌水平。性能测试报告显示,Gemini 2.5 Deep Think在LiveCodeBench V6编程测试、Humanity's Last Exam综合评估、IMO 2025数学竞赛以及AIME 2025数学考试等多个权威基准测试中均取得领先成绩。

目前,Google AI Ultra订阅用户可在Gemini应用中每日限次使用Deep Think功能。当用户选择Gemini 2.5 Pro模型时,输入栏将显示"Deep Think"选项。该功能已自动整合代码执行和谷歌搜索等实用工具。据官方透露,谷歌计划在未来数周内通过Gemini API向部分开发者开放带工具和不带工具的Deep Think模型版本。