通义千问发布了其下一代原生多模态模型 Qwen3.8-Omni-Flash
支持文本、图像、音频和视频输入,上下文窗口为 100 万 token
在 29 个基准测试中,与 Qwen3.5-Omni-Plus 相比,平均提升超过 25%
亮点:
🎧 音频输入成本每小时下降 98%+
🎥 音频 + 视频输入成本每小时下降 93%+
发布于 马来西亚
