感谢OpenAI 宣布推出其最新旗舰生成式 AI 模型 GPT-4o,该模型将在未来几周内分阶段集成至 OpenAI 的各个产品之中。最让人惊喜的是,GPT-4o 将收费供给给所有用户使用。
综合 TechCrunch 等外媒报道,OpenAI 首席技巧官穆里・穆拉蒂 (Muri Murati) 表示,GPT-4o 将供给与 GPT-4 同等水平的智能,但在文本、图象以及语音解决方面均取得了进一步提拔。
“GPT-4o 可以综合利用语音、文本和视觉信息从事推理,”穆拉蒂在 OpenAI 公司总部举行的主题演讲中表示。GPT-4 是 OpenAI 此前的旗舰模型,可以解决由图象和文本混合而成的信息,并能完成诸如从图象中提取文字或描述图象内容等任务,GPT-4o 则在此基础上新增了语音解决能力。
GPT-4o 的运行速度将大大提拔,最大亮点在于其语音交互模式选拔了新技巧。OpenAI 一直致力于让用户通过语音与 ChatGPT 从事交流,仿佛与真人对话一般。然而,之前的版本由于延迟问题,严重影响了对话的沉浸感。GPT-4o 则选拔了全新的技巧,让聊天机器人对话的响应速度大幅提拔。
IT之家注意到,发布会上 OpenAI 展现了使用 GPT-4o 从事语音对话的示范。示范者提问结束后,GPT-4o 几乎可以即时回应,并通过文本转语音性能从事朗读,让对话感觉加倍自然逼真。
另一个示范展现了 GPT-4o 根据要求调整说话时语气,GPT-4o 可以根据指令改变声音,从夸张戏剧到冰冷机械,展现了出色的可塑性。最后,示范还展现了 GPT-4o 的唱歌性能。
以往,OpenAI 发布新版 ChatGPT 模型时,通常会将其置于付费墙之后。不过这次 GPT-4o 将收费供给给所有用户,付费用户则可以享受五倍的调用额度。
此外,OpenAI 还发布了桌面版的 ChatGPT 和新的用户界面。“我们认识到这些模型正变得越来越复杂,” 穆拉蒂说道,“但我们希望用户与人工智能模型的交互体验能够加倍自然、轻松,让用户可以将注意力完全集中在与模型的协作上,而无需在意界面本身。”