Google 带着全新的 Gemini 3.8 Flash 强势回归。在前阵子刚发布 Gemini 3.7 之后,这个新模型的迭代速度确实让人有些惊讶。回顾过去,Google 在和 OpenAI 以及 Anthropic 的竞争中经历了不少起伏,之前的几款模型在实际体验上甚至有些不尽人意。但这次的 3.8 Flash 确实展现出了极强的竞争力,尤其是在性价比上。
在软件工程基准测试 DeepSWE v1.1 中,Gemini 3.8 Flash 拿到了 73.7% 的成绩,不仅超过了 GPT 5.6 Sol,基本与 Claude Opus 5 持平。在法律领域的 Harvey 测试中,它也凭借出色的表现拿下了第一。更夸张的是它的价格,目前推广期每百万输入 token 只要 0.75 美元,输出 3.75 美元,即使后续恢复到 1.5 美元和 7.5 美元,也依然比同级别的 GPT 5.6 Terra 便宜不少。
当然它也存在短板,在处理真实世界知识工作和复杂终端编码时,它的表现就比较平庸,网页设计和 PPT 生成的视觉美感也稍显逊色。不过在实际演示中,它用单条提示词生成的 3D 珠穆朗玛峰地形图交互效果非常惊艳,甚至还能用单条提示词写出一个简化版的《毁灭战士》游戏。
现在的模型竞争已经走出了单纯拼参数的阶段,不同模型在不同垂直领域的表现千差万别。对于企业和开发者来说,盲目追求最贵最强的顶级模型并不明智,根据具体任务建立自己的内部基准测试,把 Gemini 3.8 Flash 这种极具性价比的模型用在它擅长的代码和法律任务上,才能把每一分钱都花在刀刃上。
#Gemini3.8Flash##谷歌AI# http://t.cn/AX0oSCuP
发布于 上海
