谷歌发布Gemini 3.6 Flash:被指“史上最差模型”!
当地时间7月21日,谷歌正式发布了新一代模型Gemini 3.6 Flash,然而这款备受期待的产品一上线却遭遇了铺天盖地的负面评价。该模型拥有长达100万个token的上下文窗口(相当于1500页A4纸、3万行代码或1小时视频内容),定价为每100万个输出token 7.5美元,支持文本、图像、语音和视频输入,并且据称在多步骤工作流中可减少17%的输出token消耗。然而,这些技术参数并未能掩盖其在性能上的重大缺陷。
根据人工智能分析智能指数的评估,Gemini 3.6 Flash仅获得50分,该指数衡量模型的代理能力、通用能力、编码能力和科学推理等维度。这一分数不仅与其前代3.5 Flash完全持平,更糟糕的是,它显著低于Meta Spark 1.1、GLM-5.2、GPT-5.6 Luna、Sonnet 5、Grok 4.5以及GPT-5.6 Terra等竞品模型。
在具体基准测试中,该模型在SWE-Bench Pro(公开版)上被7月8日发布的Grok 4.5击败,在MLE Bench上则被Claude Sonnet 5超越。分析指出,在几乎所有相关基准测试中,Gemini 3.6 Flash都被许多更便宜、更老旧的模型所超越,这使其可能成为DeepMind历史上最令人失望的模型之一。
此次发布的时间点也极为不利——恰逢中国涌现出一批令人惊艳的开源AI模型,例如Moonshot的Kimi K3,该模型凭借新颖的架构创新实现了显著的成本节约,同时达到了前沿级别的性能。此外,谷歌同期还发布了性价比较高的Gemini 3.5 Flash-Lite(每秒可生成350个输出token)以及面向网络安全应用的Gemini 3.5 Flash Cyber,但这些产品的推出也未能扭转外界对Gemini 3.6 Flash的负面评价。
业界普遍认为,谷歌此次在AI模型竞争中暴露出明显的性能短板,其市场地位正面临严峻挑战。
#热门微博##科技快讯##人工智能##谷歌#
