这很盒里吧
26-09-14 17:42 微博认证:AI博主

试了下效果,DeepSeek 的 App 内在几乎每个要用到语音的地方都标注了「朗读」,应该还是「ASR → 文本推理 → TTS 朗读」的旧方案。

记得 DeepSeek 刚火那阵,就有很多厂商拿 R1 文本模型加工过,用同样的技术路径做过智能音箱、AI 交互玩具之类。

语音肯定不是 DeepSeek 的核心战场,之前梁文锋自己也说过:「多模态对 C 端产品很重要,但对智能的上限,它是一个组件,不是主线本身。」

有趣的地方在于,这次的四种音色全部取自海洋意象、呼应鲸鱼 logo,这是我第一次在 DeepSeek 的产品里看到他们有意识在做「人格」。

感觉在大举扩张、短期吸收了许多新人之后,DeepSeek 未来在产品端也会有更多的变化。

#你心中的DeepSeek语音什么样#

发布于 新加坡