数据世界
产业资讯 宏观经济 企业动态 人物动态 科技数码 数据洞察 AI前沿 行业峰会 热点资讯

OpenAI推出GPT-RealTime语音模型,升级功能并降价,语音大战再升级

2025-08-31来源:ITBEAR编辑:瑞雪

在AI技术日新月异的今天,OpenAI再次引领潮流,于近日凌晨正式推出了专为开发人员设计的语音转语音模型——GPT-RealTime。与此同时,OpenAI还对其API功能进行了全面升级,新增了远程MCP服务器支持、图像输入功能以及SIP电话呼叫支持。

据OpenAI官方介绍,GPT-RealTime是其迄今为止最先进的语音合成模型,该模型在遵循复杂指令、精确调用工具以及生成自然、富有表现力的语音方面取得了显著进步。GPT-RealTime不仅能够流畅地朗读重复的字母和数字,还能无缝切换语言,甚至能够捕捉到笑声等非语言信号,为用户带来更加真实、生动的对话体验。

除了技术上的突破,OpenAI还为用户带来了两个全新的语音选项——Cedar和Marin,这两个语音将在Realtime API中独家提供,为用户带来更多样化的选择。

在定价方面,OpenAI也展现出了极大的诚意。通用版Realtime API和全新的GPT-RealTime模型即日起向所有开发者开放。GPT-RealTime的定价策略为每百万token音频输入32美元,缓存输入每百万token仅需0.4美元,而每百万token音频输出的价格为64美元。相较于之前的gpt-4o-realtime-preview版本,GPT-RealTime的价格下调了20%,这无疑将吸引更多开发者加入到GPT-RealTime的应用开发中。

OpenAI此次还增加了对对话上下文的细粒度控制,允许开发者设置智能token限制,并一次截断多个回合,这一改进将显著降低长会话的成本,为开发者提供更加灵活、高效的开发环境。

自去年10月OpenAI发布Realtime API公开测试版以来,已有数千名开发者使用该API并提出了宝贵的建议。此次GPT-RealTime的推出,无疑是对这些开发者反馈的积极回应。

然而,尽管GPT-RealTime受到了广泛关注和期待,但也有一些开发者对其表现提出了质疑。有用户认为,虽然GPT-RealTime在语音合成方面取得了显著进步,但其声音仍然带有一定的机械感,且旧的语音角色在表现力上只是略有提升。

为了提升GPT-RealTime的性能,OpenAI在音频质量、理解用户指令以及遵循指令等方面进行了大量改进。GPT-RealTime能够产出更自然的高质量语音,并能遵循细粒度的指令,如“快速专业地说话”或“用法国口音富有同情心地说话”。同时,该模型还能捕捉笑声等非语言线索,在句子中切换语言,并调整语气,为用户提供更加愉悦的对话体验。

在构建语音转语音应用时,开发者通常需要向模型提供一系列行为指令。OpenAI此次专注于改进模型对这些指令的遵循程度,使得即使是微小的指令也能为模型传递更多信息。这一改进将使得GPT-RealTime在处理复杂的多步骤请求时更加得心应手。

OpenAI还改进了异步函数调用功能。长时间运行的函数调用将不再中断会话流程,模型可以在等待结果时继续流畅地对话。这一功能的提升将使得GPT-RealTime在处理需要等待外部响应的场景时更加自然、流畅。

与传统将语音转文本和文本转语音的多模型链式流程不同,Realtime API通过单个模型和API直接处理和生成音频。这一创新的设计减少了延迟,保留了语音中的细微差别,并使得其响应更加自然、富有表现力。同时,Realtime API还新增了远程MCP服务器支持、图像输入功能以及SIP电话呼叫支持等实用功能,为开发者提供了更加便捷、高效的开发体验。

为了防止实时语音对话被滥用,Realtime API包含了多层安全防护和缓解措施。OpenAI对Realtime API会话采用主动分类器进行监控,一旦检测到有害内容,将立即中止对话。开发者还可以使用Agents SDK添加自己的额外安全防护措施,确保对话的安全性和合规性。

iPhone17系列销售势头猛 本周国内激活量或冲破1000万台大关
【CNMO科技消息】11月14日,据数码博主爆料称,iPhone17系列国内激活量将于本周突破1000万台。截至11月2日,该系列在国内的激活数量已突破825万台,其中iPhone 17 Pro Max约3…

2025-11-14

95后「AI天才少女」罗福莉加入小米,AI圈人才争夺再掀热潮
DeepSeek员工、有天才名号、小米雷军出千万年薪挖角,这几个因素叠合起来,让不怎么关注 AI 的网友都知道了这位 95 后技术大牛。暂且不说这“千万年薪”是不是真消息,能让雷军出动请人, 相信大家都能从…

2025-11-13

原DeepSeek核心成员罗福莉加盟小米MiMo团队
近日,一则科技圈的重磅消息引发广泛关注:曾参与DeepSeek-V2大模型研发的“天才少女”罗福莉,正式宣布加入小米Xiaomi MiMo团队,并表示将“全力奔赴心中的AGI(通用人工智能)”。这一消息不仅证实了此前关于她跳槽小米的传闻,更透露出小米在AGI领域的战略布局。

2025-11-13

双11手机市场:苹果销量领跑,小米成国产手机销量佼佼者
【太平洋科技】11 月 12 日消息,本年度的双 11 正式收官,各大电商平台的品类销售排名也随之揭晓。据京东官方数据,在全部品牌销量累计榜中,苹果、小米、vivo 占据前三席位。在全部品牌销售额累计榜…

2025-11-12

中国折叠屏手机市场回暖,2025年全球出货量或达5470万台引关注
基于前三季度的良好表现,IDC预计2025年中国折叠屏手机市场出货量将接近千万台,延续此前持续增长的趋势。 机构指出,折叠屏手机正成为智能手机市场的全新增长极,2025年全球出货量预计达5470万台,中国市…

2025-11-12

联想双十一成绩亮眼:89亿销售额揽19冠 平板与多品类齐发力
不仅一举夺得笔记本电脑总榜自营销量冠军与POP销售额冠军,更在细分品类中实现了多维度领跑。旗下的ThinkPad与ThinkBook分别拿下POP销售额冠军与自营高端销售额冠军;游戏本方面,联想更是包揽了自营…

2025-11-12

2025年Q3中国折叠屏手机回暖:出货量增17.8\% 体验升级或成高端市场关键赛道
【环球网科技综合报道】11月11日消息,根据IDC最新手机季度跟踪报告显示,2025年第三季度,中国折叠屏手机市场迎来显著回暖,该季度出货量达到263万台,同比增长17.8%。市场动能的恢复,一方面得益于手机…

2025-11-11

取消实体卡槽换来长续航!纯eSIM版iPhone17 Pro多场景续航表现亮眼
在美国、加拿大、日本等特定市场销售的纯 eSIM 版本,由于取消了实体 SIM卡槽,获得了更大的电池空间,续航表现明显优于实体卡槽版本。在综合活跃使用测试中,eSIM 版续航达 16 小时 12 分钟,比实…

2025-11-11

荣耀400系列发货量破600万创佳绩 荣耀500系列新设计蓄势待发
在海外首发时,销量就达到前代产品的2-3倍。在中国市场上,荣耀400系列首销日销量同比荣耀300系列增长195%,同比荣耀200系列增长138%,打破近三年荣耀手机首销日销量纪录。6月30日,该系列全球累计激…

2025-11-11