Google 终于更新了 Gemini 的大版本号,发布了全新的 Gemini 4 Argon。从最新的智能体 Arena 数据来看,它目前排在第 8 位,刚好略高于 Sol 5.6,但依然处于 GPT 6.1 Sol 和 Opus 5.5 之下。
这次更新最亮眼的地方在于价格。它卡在了极佳的帕累托前沿位置,比 GPT 6.1 Sol 便宜了大约三分之一,比 Opus 5.5 更是便宜了将近 70%。在当前大模型应用落地的阶段,这种极致的性价比对开发者来说确实非常吸引人。
不过在实际的评测中,它的表现有些像坐过山车。在金门大桥的 3D 生成中,画面的空间感和连贯性都非常好,和 Sonnet 5.5 相比也毫不逊色。但到了圣域群岛和巴别塔这类需要严密逻辑的场景里,画风就有些失控了。水面接缝粗糙,人物甚至会莫名其妙地悬在半空中,细节设计感明显落后于 Sonnet 5.5 和 GPT 6.1 Sol。在游戏生成测试中,操控卡死的问题也比较明显。
这也暴露了 Gemini 4 Argon 当前最大的隐忧,那就是输出的稳定性。它在某些特定提示词下能跑出高光表现,但整体的下限也比较低。对于想要用它替代主流模型的团队来说,可能需要在提示词工程和人工引导上多花一些心思了。
#Gemini4##谷歌大模型##前沿AI模型# http://t.cn/AXWCSXZ1
发布于 上海
