资讯
Build more natural voice experiences with GPT‑Live‑1 in the API
📋总体概括
OpenAI发布GPT-Live-1语音模型API,将实时、全双工语音对话能力正式开放给开发者。该模型具备更强的指令遵循能力、支持自定义音色,并新增电话线路接入支持,瞄准语音代理与客服场景的商业化落地。此举意味着OpenAI把语音交互从演示级产品推向生产级基础设施,与ElevenLabs、谷歌等语音AI服务商正面竞争。
⚡关键信息
- ▸OpenAI推出GPT-Live-1,通过API提供自然的全双工语音对话能力
- ▸模型强调更强的指令遵循能力,适合构建可控的语音代理
- ▸支持自定义音色,便于企业打造品牌化语音体验
- ▸新增电话(telephony)支持,可直接用于电话客服等场景
- ▸语音交互能力从产品内嵌功能升级为开放的开发者基础设施
🔥犀利点评
全双工语音+电话接入,这两个关键词暴露了OpenAI的真实意图:吃掉电话客服这个万亿级存量市场。自定义音色和指令遵循的强化,说明它已经不满足于演示级酷炫,而是冲着生产环境的可靠性去打。ElevenLabs们的好日子可能到头了——当平台型玩家把语音做成API标配,垂直语音公司的护城河会迅速变浅。真正的分水岭在延迟、成本和电话线路生态,这才是下一战的战场。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 OpenAI News 阅读全文 →