【OpenAI在API中推出GPT-Live-1全双工语音模型】

今天
【OpenAI在API中推出GPT-Live-1全双工语音模型】报道,9 月 10 日,OpenAI 官方宣布在 API 中推出 GPT-Live-1 全双工语音模型。起因是传统语音代理需拼接语音识别、大语言模型和语音合成三个组件,每次交接增加延迟并易丢失对话节奏与上下文。经过研发,GPT-Live-1 将听和说整合在单一模型中,可实时响应打断和确认,同时将深度推理委托给后端模型如 GPT-6Astra 或 Luna。结果显示,该模型在全双工基准测试中较 GPT-Realtime-2.1 提升 30 个百分点,配合 GPT-6Astra 在 Tau3 语音智能评测中排名第一;语言学习平台 Speak 早期评估显示思考停顿期间的打断减少近 80%,某医疗客户代码库简化 80% 并减少 2.3 万行代码。该模型支持电话部署、12 种新语音,前端语音层定价为每分钟 0.05 美元,目前已在 API 中可用,Yelp、Fin、Cognition 等企业已接入测试。
免责声明:
内容来源金色财经、欧意交易所、gate.io交易平台以及Binance交易所官网
本站不对其做任何背书,也不代表赞成作者观点,如有失察或对您造成影响,可联系我们删除

发表评论

快捷回复: 表情:
AddoilApplauseBadlaughBombCoffeeFabulousFacepalmFecesFrownHeyhaInsidiousKeepFightingNoProbPigHeadShockedSinistersmileSlapSocialSweatTolaughWatermelonWittyWowYeahYellowdog
验证码
评论列表 (暂无评论,10人围观)

还没有评论,来说两句吧...