广告

OpenAI在API中推出GPT-Live-1全双工语音模型

发布日期:2026-09-11 15:49 阅读:
金牌财经排行榜报道,9 月 10 日,OpenAI 官方宣布在 API 中推出 GPT-Live-1 全双工语音模型。起因是传统语音代理需拼接语音识别、大语言模型和语音合成三个组件,每次交接增加延迟并易丢失对话节奏与上下文。经过研发,GPT-Live-1 将听和说整合在单一模型中,可实时响应打断和确认,同时将深度推理委托给后端模型如 GPT-6Astra 或 Luna。结果显示,该模型在全双工基准测试中较 GPT-Realtime-2.1 提升 30 个百分点,配合 GPT-6Astra 在 Tau3 语音智能评测中排名第一;语言学习平台 Speak 早期评估显示思考停顿期间的打断减少近 80%,某医疗客户代码库简化 80% 并减少 2.3 万行代码。该模型支持电话部署、12 种新语音,前端语音层定价为每分钟 0.05 美元,目前已在 API 中可用,Yelp、Fin、Cognition 等企业已接入测试。

发表我的意见

专栏作者

8468

文章

0

提问

792万+

阅读量

0

回答

67万+

被赞

0

余额

关于我们 联系我们 加入我们 免责声明 广告服务 Sitemap 标签Tag 侵权文章删除:13607219@qq.com 微信:wenlian123com Investor Relations © 2025 金牌网 中值联认证中心(北京)有限公司版权所有 ICP备案:京ICP备20020888号 增值电信经营许可证:京B2-20201851