快科技 7 月 9 日消息,据媒体报道,OpenAI 发布新一代语音模型 GPT-Live,让人与 AI 的对话更加自然流畅,体验更接近真人交流。
据介绍,目前每周有超过 1.5 亿人使用 ChatGPT 的语音和听写功能,应用场景涵盖免提日常帮助、语言练习、睡前故事讲述,以及通勤途中的闲聊陪伴。
此前的语音功能依赖于较为传统的回合制模型,在回答准确性和对话自然度方面存在局限,有时难以维持顺畅的交互节奏。
而 GPT-Live 实现了 " 边听边说 ",并能通过 " 嗯哼 " 等简短回应传递倾听信号,增强对话真实感。该模型专为持续交互设计,每秒可多次判断是继续聆听、开始说话、暂停、打断还是调用工具,具备高度的灵活应变能力。
OpenAI 表示,GPT-Live 是其目前最智能的语音模型,集成了最新的前沿基础模型(GPT-5.5),支持网络搜索、深度推理和复杂任务处理。在执行任务的同时,模型能够保持对话连续,并在任务完成后即时反馈结果。此外,GPT-Live 还支持实时翻译,并能以视觉卡片形式呈现天气、股票、体育等信息。
在交互细节上,当用户稍作停顿思考时,ChatGPT Voice 会耐心等待,而非贸然插话;即便存在车辆驶过或周围交谈等背景噪音,模型也能更好地聚焦用户声音,抗干扰能力显著增强。
OpenAI 宣布,自周三起向全球 ChatGPT 用户推出两个版本:GPT-Live-1 和 GPT-Live-1 mini。其中,GPT-Live-1 默认面向 Plus 和 Pro 用户,Free 用户则默认使用 GPT-Live-1 mini。
用户点击语音按钮即可体验 GPT-Live 对话功能。目前,该模型暂不支持 ChatGPT 内的语音通话与屏幕共享,OpenAI 表示正积极推动相关功能尽快上线。


登录后才可以发布评论哦
打开小程序可以发布评论哦