张大峰
26-05-14 17:10 微博认证:汇财董事

一句话最直白结论:
姚顺宇把在 Claude 3.7 Sonnet 做的「深度思考+超级编程+智能体」全套绝活,完整搬到了谷歌 Gemini,直接做出了碾压 3.7 的 Gemini 3 Deep Think。

下面给你讲清楚他在 Gemini 到底做了什么、带来了什么改变:

一、他在 Gemini 核心做的3件大事(直接对标3.7)

1. 做出 Gemini 最强王牌:Deep Think 深度思考模式

就是他把 Claude 3.7 的 Extended Thinking 深度推理架构,升级成了多路径并行推理(同时跑16条思考路径,择优)

• 直接解决 Gemini 以前推理弱、逻辑跳、长任务容易崩的老问题

• 抽象推理 ARC‑AGI‑2 做到 84.6%,比 Claude 4.6 高15%,GPT‑5.2 高30%

2. 把 Gemini 编程能力干到全球顶级,碾压 3.7

他直接复刻+升级了自己在 Anthropic 做的 Claude Code 智能体编程:

• Codeforces 算法竞赛 Elo 3455分(传奇大师),全球只有7个人类程序员比它强

• SWE‑bench 工程代码准确率 76.2%,高于 Claude 3.7、GPT‑4o

• 能读整个项目、跨文件重构、深度Debug、做架构设计,直接对标、反超 3.7

3. 优化推理成本,大幅降价

用物理数学功底优化算法,让复杂推理成本只有 OpenAI 的 1/300~1/400
谷歌直接能用更低成本,做比 Anthropic 更强的复杂任务。

二、他在 Gemini 解决了 Claude 3.7 的所有缺点

1. 响应速度更快:并行推理优化,深度思考模式延迟比3.7低

2. 用量不卡死:谷歌算力无限,不会像 Claude Pro 那样频繁限流

3. IDE生态更强:谷歌全生态打通,实时补全+深度思考兼顾

4. 知识更新更快:联网能力强,2024后新框架、新API支持更好

三、一句话对比(最核心)

• Claude 3.7 Sonnet = 姚顺宇的1.0版深度思考+超级编程

• Gemini 3 Deep Think = 姚顺宇的2.0升级版,直接吊打3.7

四、对你实际用的影响

• 日常写代码:Copilot > Gemini > 3.7

• 复杂项目/架构/深度Debug:Gemini 3 Deep Think ≥ Claude 3.7 Sonnet

要不要我给你整理一份Gemini Deep Think、Claude 3.7、Copilot 的终极横向对比表?

发布于 北京