新智元
26-07-22 09:25 微博认证:新智元官方微博

谷歌「史上最差」AI模型发布!#科技先锋官#

Gemini 3.5 Pro延期,谷歌DeepMind连夜甩出Gemini 3.6 Flash、Gemini 3.5 Flash-Lite、Gemini 3.5 Flash Cyber三款「阉割版」模型。上线即遭吐槽,被网友戏称「史上最差」。

前端生成全线崩盘,组件嵌套混乱、交互逻辑断裂,不敌Claude Fable 5、GPT-5.6 Sol,甚至输给Meta的Muse Spark 1.1。开发者直言:「这是我真正见过的最差结果。」

空间推理同样翻车,位置关系、方向判断准确率相比3.5 Flash明显退步,即便开启高性能「high thinking」也无改善。CursorBench测试中,Gemini 3.6 Flash还不如Cursor的Composer 2.5。

谷歌自家测试显示其代码任务被其他模型超越,仅视觉和上下文基准领先。第三方Artificial Analysis评测中,得分与3.5 Flash完全相同,落后于GLM-5.2、5.6 Luna、Sonnet 5、Grok 4.5等一众竞品。

更尴尬的是知识截止日期造假,模型声称已更新到2026年3月,实际认知仍停留在2025年1月。Flash-Lite主打每秒350 token的速度,但价格更贵、效果更差,被批「快速给出错误答案」。

谷歌坦言Gemini 3.5 Pro尚未准备好,转而押注Gemini 4的「最雄心勃勃的预训练」,据CNBC称这是谷歌史上规模最大的预训练项目。有网友讽刺,与其浪费算力,不如把资源让给Moonshot等对手。