今日OpenAI正式官宣上线GPT-Live-1实时语音模型API,面向全球开发者和企业开放商用接口,补齐了平台全双工实时语音交互的技术短板。
这款全新模型最大的优势是支持实时不间断对话、随时打断交互,同时自带专业的背景噪声过滤、人声优化功能,解决了传统语音模型延迟高、无法打断、嘈杂环境识别不准的常见问题。
相比过往语音模型,GPT-Live-1的对话流畅度、语义理解精准度大幅提升,适配场景十分广泛,可直接应用于智能客服、电话AI智能体、实时语音翻译、智能车载交互、虚拟主播等各类商用场景。
随着API正式开放,中小开发者和企业无需自主研发底层语音大模型,可直接接入成熟技术快速落地产品,大幅降低实时AI语音产品的研发成本和周期,也标志着OpenAI全面深耕实时交互AI商用赛道,进一步完善自身商业化产品矩阵。
发布于 福建
