风险提示:理性看待区块链,提高风险意识!
USDT USDT $1.00 0.01%
XRP XRP $1.43310000 0.19%
BNB BNB $637.54000000 0.02%
USDC USDC $0.99963000 0.01%
SOL SOL $86.49000000 0.99%
TRX TRX $0.32360000 1.25%
BTC BTC $67,234.00 2.34%
ETH ETH $3,456.00 1.23%
CoinMeta Skill
限时免费体验

让 AI 更快获取有效、准确、可行动的币圈全景信息

OpenAI 推出全新语音对话模型 GPT-Live-1 系列,重构实时语音交互体验

摘要

全新语音架构:从串行到全双工 OpenAI 正式发布两款原生语音对话模型——GPT-Live-1 和 GPT-Live-1 mini。二者均基于全双工语音架构设计,首次实现「边说边听、边听边想、边想边应」的连续交互能力。与过去依赖「语音...

OpenAI 推出全新语音对话模型 GPT-Live-1 系列,重构实时语音交互体验
全新语音架构:从串行到全双工 OpenAI 正式发布两款原生语音对话模型——GPT-Live-1 和 GPT-Live-1 mini。二者均基于全双工语音架构设计,首次实现「边说边听、边听边想、边想边应」的连续交互能力。与过去依赖「语音转文字→文本推理→文字转语音」三段式流程不同,新模型在用户开口的瞬间即启动理解与响应准备,支持自然打断、无缝插话与多轮语义延续,真正贴近人类对话节奏。 能力升级:更懂何时说话,更会回答复杂问题 此次升级重点解决两大长期痛点:一是系统误判用户停顿而提前插话;二是面对多步骤、跨领域或需外部调用的复杂请求时响应乏力。新模型在语音层持续运行的同时,可将语义意图实时路由至更先进的文本后端(如 GPT-5.5),从而动态调用搜索、逻辑推理、工具调用或代理执行等能力,使语音不再仅是输入输出通道,而是智能任务入口。 默认启用与分层服务 GPT-Live-1 mini 已作为 ChatGPT 语音功能的默认模型面向所有用户上线。付费订阅用户则可解锁完整版 GPT-Live-1,获得更强的上下文记忆深度、更长的连续对话稳定性及更丰富的多语言实时处理能力。目前,ChatGPT 的语音与听写功能已覆盖超 1.5 亿活跃用户。 不止于说话:静默理解与多模态延伸 新模型具备「主动静默」能力——可在用户长时间不发声期间持续建模上下文,保持对话状态不丢失;当用户再次开口,系统能基于此前完整语境即时响应。此外,语音指令可触发非语音反馈:例如查询天气时同步显示可视化图表,解释数学公式时生成分步图示,实现语音驱动的轻量级多模态交互。 务实演进:不追求拟人陪伴,专注可靠任务协同 OpenAI 明确表示,GPT-Live 系列并非以「情感陪伴」或「人格化角色」为目标,而是聚焦于提升信息获取、任务执行与跨语言协作的效率与可靠性。模型内置分层安全机制:面向青少年用户自动适配表达方式与内容尺度;对高风险话题(如自伤倾向)可识别语义并主动提供权威支持资源链接,而非仅作合规回应。当前版本已在数十种主流口语场景中完成针对性优化,但暂未公开具体语种清单与口音适配细节。

评论 (5)

登录 后即可发表评论
PP
PP 3周前

不搞拟人陪伴,专注任务协同,内置安全机制,务实又负责。

0 回复
W。W
W。W 3周前

可惜没公开语种和口音细节,希望后续能完善,让更多人用得好。

0 回复
茗雅
茗雅 3周前

这升级挺牛啊,全双工架构让交互更自然,还解决痛点,能更好完成任务。

0 回复
think
think 3周前

主动静默和多模态延伸实用,不止说话还能有其他反馈,提升体验。

0 回复
火红玫瑰

新模型默认启用方便,付费功能更强,覆盖用户多,有市场潜力。

0 回复
更多