OpenAI 推出 GPT-Live 全双工语音控制,赋能 Codex 与 ChatGPT 桌面端免提编程
OpenAI 将具备全双工能力的 GPT-Live 音频模型集成至 ChatGPT 桌面应用(macOS/Windows),深度支持 Codex 和 ChatGPT Work 智能体系统,实现语音驱动的多线程编码、PR 审查与调试,面向超千万周活用户开启免提式软件开发新范式。

在其更自然的 GPT-Live 音频 AI 模型发布两周后 该模型具备全双工能力(可同时听与说) OpenAI 正将该模型直接集成至开发者工作流中。
该公司宣布 GPT-Live 现已为 ChatGPT 桌面应用程序提供支持 该应用适用于 macOS 和 Windows 系统,并直接与 Codex 和 ChatGPT Work 等智能体系统集成(二者是 ChatGPT 桌面应用程序内提供的独立功能体验)。
当 OpenAI 于 2026 年 7 月 8 日首次推出 GPT-Live 时,它引入了一种连续音频模型,能够同时听与说——消除了僵化的轮流发言机制,同时将复杂推理任务交由后台模型(如 GPT-5.5)处理。
此次发布将这一对话层扩展至技术性任务,使软件工程师能够通过自然语音指令编排多线程编码作业、审查拉取请求(pull requests)以及调试应用程序。
因此,它可能开启一个“免提式”软件开发的新时代,甚至催生面向现场群体协作的实时编程聚会,覆盖 Codex 与 ChatGPT Work 平台 逾 1000 万周活跃用户 中的用户。 ChatGPT Work当然,Codex 是 OpenAI 为其专注编码的模型及工具套件所命名的名称;但今年该公司已将其拓展为一个更广泛的 通用生产力平台。 一位 OpenAI 发言人向 VentureBeat 表示,这是语音激活功能首次
OpenAI 发布了一段 宣传视频 视频展示了部分公司员工——Codex 开发者体验工程师 Jason Liu 与 Codex 技术人员 Guinness Chen——在同一个房间内,向同一 ChatGPT 桌面应用程序会话发声,各自发出不同指令,并与同一模型进行对话。
新启用的功能
该集成的核心在于将实时语音层与底层执行引擎解耦。
尽管 GPT-Live 维持流畅对话——插入诸如“明白了”等自然口头确认语而不打断用户——但它将繁重的计算工作负载交由后台推理模型处理。
在 macOS 上,桌面应用程序整合了“Appshots”(应用截图)与屏幕上下文功能,使 ChatGPT Voice 能够分析最前端窗口,同时结合本地文件、代码库结构及已启用插件进行分析。
这种架构创造出一种结对编程动态:开发者以对话方式探讨问题,而智能体则异步执行任务。
开发者无需手动暂停编码会话以输入详细指令或切换窗口,即可全程免提操控系统。
全双工引擎动态决定何时发言、暂停或调用工具,即使后台智能体正在处理复杂的代码修改,也能维持对话状态。
仅凭语音即可指挥编码与复杂构建流程
本次更新的核心运行能力集中于跨 Codex 与 ChatGPT Work 环境的多任务执行。
软件工程师可通过单条语音提示启动多个并发任务线程。例如,一名准备发布某项功能的开发者可指示系统同步排查一个待解决的身份验证漏洞、审查一项待合并的 API 迁移拉取请求,并生成缺失的单元测试。
桌面应用程序在不同上下文间协调这些操作,通过 Slack 对话、GitHub 仓库及本地代码库追踪问题。
开发者还可通过语音将设计原型图转化为可运行代码,并将任务拆分至前端、后端及测试各层。
借助对多文件夹项目(版本 26.715)的支持以及通过 iOS 实现的远程执行能力,工程师可在不切换应用程序或逐行管理各个进程的情况下,检查任务进度、回应智能体提示,并重新定向正在进行的任务。
专有许可
OpenAI 的语音启用型桌面版发布采用专有商业企业模式。访问权限仅限 Plus、Pro、Business、Enterprise 及 Education 计划的付费订阅用户。
对于个人开发者及企业工程部门而言,这种商业结构意味着模型权重、语音处理流水线及智能体状态架构完全封闭。
组织无法修改或自行托管底层系统。此外,通过 ChatGPT Voice 启动的任务将直接从现有 Codex 与 ChatGPT Work 计划配额中扣除标准用量,语音触发的操作与标准智能体工作负载被同等对待。
社区反响
开发者社区立即注意到,将连续全双工语音引入自主编码工作流所带来的深远影响。
针对版本 26.715 发布公告——该公告详述了语音集成与多文件夹项目支持——AI Insider 记者 @ChrisGPT 在 X 平台发文指出:“今天 OpenAI 将发布 Codex 的语音与远程指导功能!距离个人通用人工智能(AGI)又近了一步。”
早期技术反馈显示,开发者普遍热衷于免提编排复杂智能体任务,尤其在离开工作站或远程管理构建流水线时。
立即咨询 JOTO
JOTO 提供覆盖企业智能体规划与搭建、AI 平台私有化部署、RAG 知识工程、AI 安全治理、FDE 驻场共创及持续运营优化的全周期 AI 落地服务,帮助企业把验证中的 AI 能力转化为安全、可控、可持续迭代的生产力。 联系 JOTO 获取 AI 落地咨询
想把这些做法用到你的业务里?
留下你的场景和痛点,我们帮你判断从哪一步开始。
联系我们


