新闻

OpenAI 最智能语音模型:GPT-Live-1/mini 登场,边听边说让 AI 对话更接近真人聊天

1 分钟阅读
来源:ithome.com
IT之家 7 月 9 日消息,OpenAI 今天(7 月 9 日)发布 GPT-Live 系列模型, 定位新一代全双工语音模型,可同时聆听与说话,让 AI 对话感觉更接近真人。 GPT-Live 系列模型目前开放 GPT-Live-1 与 GPT-Live-1 mini 两个版本,即日起向全球 ChatGPT 用户开放,其中官方面向 Go、Plus 和 Pro 订阅用户开放 GPT-Live-1 模型,免费用户可以调用 GPT-Live-1 mini 模型。IT之家附上相关视频如下: 架构方面,GPT-Live 系列模型采用全双工架构,不再依赖单轮结束后再响应,可在同一时间持续处理输入和输出,模型可“每秒多次”判断是否说话、继续倾听、暂停、打断或调用工具,从而让对话更接近真人聊天体验。 在面对复杂任务时,GPT-Live 系列模型拆分处理连续交互和深度推理。模型在前台维持语音对话流,同时把网页搜索、复杂推理或更复杂任务委托给 GPT-5.5 系列模型后台执行: GPT-Live-1(instant)与 GPT-Live-1 mini 调用 GPT-5.5 Instant GPT-Live-1 Medium 调用 GPT-5.5 Thinking Medium 推理强度 GPT-Live-1 High 用 GPT-5.5 Thinking High 推理强度 性能方面,OpenAI 介绍,公司专门建立了一套新的人工评测体系,重点考察语音交流中的舒适度(pleasantness)和整体交流流畅性(flow of conversation)。 相比较此前 Advanced Voice