OpenAI 桌面端 ChatGPT 上线语音交互功能,可语音操控电脑执行多步骤任务
8 月 9 日消息,OpenAI 当地时间周四宣布,已更新 ChatGPT 桌面应用,新增对 ChatGPT Voice 的支持。用户现在可以直接通过语音与 ChatGPT 对话,控制 AI 智能体,并让其在电脑上执行各种任务。

这项新功能基于 OpenAI 全新的语音模型系列 ChatGPT-Live。OpenAI 于本月早些时候推出了该系列模型。
OpenAI 表示,ChatGPT Voice 同时支持 ChatGPT Work 和 Codex,还可以调用计算机操作能力,帮助用户访问网站和应用。在 macOS 上,借助 Appshots,用户还可以允许 ChatGPT 访问屏幕上的内容,包括替代文本(alt-text)。
ChatGPT Voice 的手机版在上线之初主要侧重于提供更加流畅的语音对话体验,并改善了用户打断 AI 时的处理效果,但当时并不能直接在手机上执行操作。
此次桌面版更新则拥有更强的执行能力。用户可以通过语音向 ChatGPT 下达包含多个步骤的复杂指令,并在 ChatGPT 需要用户提供信息或进行确认时及时作出回应。
在一段演示视频中,OpenAI 展示了一名开发者通过一句指令让 ChatGPT 创建新的代码线程、提交 Pull Request,并找出一个 Bug 的根本原因。
OpenAI 还表示,用户可以通过 iOS 应用的远程访问功能,在 Codex 中使用 ChatGPT Voice。
注意到,Anthropic 也更新了 Claude 的语音模式。该功能可以调用 Anthropic 的 Opus、Sonnet 和 Haiku 模型,在 Gmail、Calendar、Slack、Notion 和 Canva 等应用中完成各种任务。
声明:本文转载自IT 之家,转载目的在于传递更多信息,并不代表本社区赞同其观点和对其真实性负责,本文只提供参考并不构成任何建议,若有版权等问题,点击这里查看更多信息!
AI 中文社