科创板日报 07-09
打造“真人感”对话!OpenAI推出GPT-Live语音模型 支持同时聆听和说话
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

财联社 7 月 9 日讯(编辑 刘蕊)美东时间周三,OpenAI 发布了新一代语音模型 GPT-Live,旨在让用户与 AI 对话的感觉更像与真人交流。GPT-Live 将取代现有的 ChatGPT 语音体验。

OpenAI 声称,每周有超过 1.5 亿人使用 ChatGPT 的语音和听写等功能进行交流。他们用它来获得日常免提帮助、练习语言、讲睡前故事,或者只是在通勤途中聊天。

ChatGPT 此前依赖于较老的、基于回合的语音模型,该模型并非总能给出准确的答案,有时也难以保持自然的对话流畅性。而最新的语音模型 GPT-Live 能够同时进行聆听和说话,并且可以通过 " 嗯哼 " 之类的回应短语来表明它在认真倾听。该模型专为持续交互而设计,它可以每秒多次决定是说话、继续聆听、暂停、打断还是使用工具。

ChatGPT-Live 在和用户对话中会使用 " 嗯哼 " 等短语表示它正在聆听

OpenAIz 在官网更新中写道:" 现在与 ChatGPT 对话的感觉更像一次真实的交流。您可以随时提问、停顿思考,或者要求 ChatGPT 放慢语速。它会自然地回应您,例如;‘嗯’,‘明白了’,让您知道它一直在跟进。此外,我们还为 GPT-Live 重新制作了 ChatGPT 的九种不同语音。"

OpenAI 表示,GPT-Live 是迄今为止最智能的语音模型,它采用最新的前沿模型(目前为 GPT-5.5),可用于网络搜索、深度推理和复杂任务。

GPT-Live 在执行任务的同时,能够继续对话,并在任务完成后给出结果。它还支持实时翻译,并能以丰富的视觉卡片形式呈现天气、股票、体育等信息。

此外,如果用户稍作思考,ChatGPT Voice 会耐心等待,而不是贸然插话打断。即使周围有背景噪音,例如车辆驶过或附近的谈话声,ChatGPT 也能更好地专注于用户的声音,而不会被分散注意力。

" 这是一个双全工(支持数据发送与接收同步进行)的模型,"OpenAI 产品负责人 AttyEleti 在简报会上表示," 这意味着它可以同时进行说话和聆听 .... 从模型层面来看,它可以持续、同步地处理输入流并生成输出流。"

OpenAI 宣布,将从周三起面向全球 ChatGPT 用户推出两个版本的 GPT-Live: GPT-Live-1 和 GPT-Live-1 mini。GPT-Live-1 是 Go、Plus 和 Pro 用户的默认版本,而 GPT-Live-1 mini 是 Free 用户的默认版本。

ChatGPT 用户可以点击语音按钮与 ChatGPT 对话并体验 GPT-Live。GPT-Live 目前尚不支持在 ChatGPT 中进行语音通话或屏幕共享,但 OpenAI 正在努力尽快添加此功能。

(财联社 刘蕊)

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

准确 体育 翻译 股票 财联社
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论