作者 | ZeR0
编辑 | 漠影
智东西报道,近日,谷歌推出了迄今为止最强大的推理模型——Gemini 2.5 Deep Think。
该模型是最近在国数奥(IMO)获得金牌的模型的改进版。高级版Gemini Deep Think在6道题目中成功解答了5道,获得金牌水平。新发布的版本在日常使用中速度更快、更易用,在2025年IMO基准测试中仍达到铜牌水平。
谷歌在今年的I/O开发者大会上首次展示了Gemini 2.5 Deep Think。新版本进行了“重大改进”,并在具有挑战性的编程、科学、知识、推理基准测试中,与OpenAI o3、Grok 4等其他不使用工具的模型相比,在LiveCodeBench V6和Humanity's Last Exam均取得最佳性能。
Gemini app中的Deep Think模型,利用思考技巧提供详细、有创意和周全的回答,帮助数学家测试数学猜想,提高Web开发任务的美观性。
Deep Think支持文本、图像、音频、视频等输入和1M tokens上下文窗口,输出长度为192K tokens。
其工作原理是利用谷歌的并行思维技术,能同时生成多个想法,并同时进行思考,甚至随着时间的推移不断修改或整合不同的想法,最终得出最佳答案。
此外,通过延长推理时间或“思考时间”,谷歌给了Gemini更多的时间来探索不同的假设,并为复杂问题找到创造性的解决方案。
谷歌还开发了新颖的强化学习技术,鼓励模型利用这些扩展的推理路径,使Deep Think成为更好、更直观的问题解决者。
Deep Think可帮助解决需要创造力、战略规划和逐步改进的问题,例如:
迭代开发和设计:在需要逐块构建复杂事物的任务上表现出色,例如提高网络开发任务的美观性。
科学和数学发现:可推理出高度复杂的问题,通过复杂的科学文献帮助制定和探索数学猜想或推理,可能加速发现之路。
算法开发和代码:在棘手的编码问题上特别出色,其中问题制定和仔细考虑权衡和时间复杂性是最重要的。
目前仅有最高级别的Google AI Ultra订阅者可选用“Deep Think”,每月订阅费为249.99美元(约合人民币1803元)。
Deep Think自动与代码执行和谷歌搜索等工具配合使用,并能产生更长的响应。
同时,达到IMO金牌水平的Deep Think模型将进一步测试,并向一小部分数学家和学者分享,用于辅助研究。谷歌计划利用这些反馈来完善该模型的未来版本。
谷歌还计划在未来几周内通过Gemini API向一组受信任的测试人员发布带和不带工具的Deep Think,以更好地了解其对开发者和企业用例的可用性。
本文由主机测评网于2026-04-19发表在主机测评网_免费VPS_免费云服务器_免费独立服务器,如有疑问,请联系我们。
本文链接:https://www.vpshk.cn/20260438795.html