谷歌公布Gemini 3 Deep Think深度思虑大模子晋级
2026-02-13 12:01:43
2 月 13 日消息,谷歌昨晚宣布对 Gemini 3 Deep Think 进行重大升级,号称是专门针对科学、研究与工程场景的开发的“推理模式”,旨在推动智能前沿发展。
据介绍,新版 Deep Think 由谷歌开发人员与各行业科学家、研究人员共同合作完成,目标是应对真实科研环境中的常见复杂问题:缺少清晰边界、未必存在唯一解,且数据往往杂乱或不完整。
此次升级的一个关键变化是,Deep Think 的可用范围进一步扩大。谷歌称,更新后的 Deep Think 从当地时间 2 月 12 日起在 Gemini 应用中向 Google AI Ultra 订阅用户开放。
注意到,谷歌首次将 Deep Think 通过 Gemini API 提供给部分研究人员、工程师与企业,采用“早期访问计划”的方式推进,并开放了申请入口以招募意向用户。
在能力表现方面,谷歌强调新版 Deep Think 在数学、算法与编程等高难推理任务上继续提升。该模式在不使用工具的情况下,在终极人类考试(Humanity's Last Exam)上取得 48.4% 的成绩;在 ARC-AGI-2 上达到 84.6%,并由 ARC Prize Foundation 验证;在 Codeforces 竞赛编程基准上获得 3455 的 Elo;并在 2025 年国际数学奥林匹克竞赛(IMO 2025)上达到金牌水平表现。
除数学与编程之外,谷歌还强调新版 Deep Think 在化学、物理等科学领域同样具备更强能力。官方称,该模式在 2025 年国际物理奥林匹克与国际化学奥林匹克的笔试部分取得金牌级结果,同时在理论物理相关的 CMT-Benchmark 上获得 50.5% 的得分。
谷歌表示,Deep Think 的目标不仅是追求基准测试成绩,还希望推动实际工程与科研应用,例如帮助研究人员解释复杂数据、帮助工程师通过代码对物理系统进行建模。谷歌称,未来将持续把 Deep Think 带到研究人员和实践者“最需要的地方”,而通过 Gemini API 开放早期访问被视为重要一步。
相关阅读
-
身体这两个部位乱推拿真的会要命,快停止科技前沿 2026-03-09 14:26:16
-
不会写代码也能用,OpenClaw若何帮通俗人脱节反复任务,提拔效率?深度解读 2026-03-09 14:22:05
-
比特币价格预测:2025 年底 15 万美元还是跌至 8.5 万?关键支撑位分析科技前沿 2026-03-09 14:11:28
-
小米2026届春季校园雇用启动:触及芯片、算法等20职类,需多轮测试科技前沿 2026-03-09 14:08:45
-
AI设计新神器来袭:无需专业技能,一句话解锁巨匠级海报创作资讯百科 2026-03-09 14:05:50
-
又一爆款预定,吉祥银河M7将于3月13日表态:1730km超长续航科技前沿 2026-03-09 14:03:26
-
2026百度Apollo Park参访:解锁智能驾驶手艺落地密码,赋能企业转型资讯百科 2026-03-09 14:00:39
-
国内油价本日将迎年内最大涨幅,网友实拍多地加油站排长队科技前沿 2026-03-09 13:57:03
-
智能办公本怎样选?科大讯飞X5等四款抢手产物功能特点大比拼,帮你找到心头好资讯百科 2026-03-09 13:55:27
-
谁动了稳定币的锚?复盘历年重大脱锚事件,一文汇总科技前沿 2026-03-09 13:54:08