返回 Codex 动态

Codex 语音协作上线:用说话启动、检查和纠偏任务

ChatGPT Voice 已能协调 Codex 任务;这份实操指南讲清如何口头分派、追踪阻塞、追加指令,以及屏幕上下文和用量边界。

来源核对:OpenAI 在 2026 年 7 月 23 日的 Codex changelog 发布 ChatGPT Voice;本文于 2026 年 7 月 27 日对照 ChatGPT Voice 官方文档 复核。

一句话判断

这不是把语音转成一段提示词,而是让你在同一个语音对话中启动独立任务、检查其他线程、追问阻塞并发送后续指令。它更适合走动、通勤或离开键盘时协调工作,不适合代替最终的代码审查。

最值得 Codex 用户关注的变化

ChatGPT Voice 可以在 Chat、Work 和 Codex 之间协调任务,并把进度、阻塞与结果带回当前语音对话。你可以自然打断、追问或改变方向,后台已经启动的任务仍会继续。

官方给出的能力边界包括:

  • 启动一个新的 Codex 任务,例如运行测试并调查失败项。
  • 检查已有线程,汇总当前进度和需要人工决定的问题。
  • 向正在运行的任务发送补充要求,而不必回到键盘逐个打开线程。
  • 在 macOS 开启 Screen context 后,用前台窗口的 appshot 补充画面和可访问文本上下文。

一个更可靠的语音工作流

1. 先说结果,不要只说动作

新建一个 Codex 任务,检查当前项目的测试失败。
先复现和定位根因,不要直接修改;完成后告诉我失败命令、根因证据和建议修复范围。

这样可以避免把一句“帮我看看测试”扩展成没有验收标准的长任务。

2. 用语音检查阻塞,而不是反复催进度

检查刚才的测试任务,只汇总已确认的进展、当前阻塞和需要我决定的事项。
如果还在运行,不要新建重复任务。

3. 追加指令时明确是否允许修改

继续刚才的任务。只修复已经确认的根因,保留无关改动;完成后运行同一组测试和构建。

语音输入更容易省略边界,所以“允许修改什么”和“怎样算完成”仍然应该说出来。

开启前必须知道的限制

  • 新对话或任务必须从语音模式开始;普通模式启动后只能使用语音听写。以前以语音开始的对话可以继续。
  • 同一时间只能有一个活跃的语音对话。
  • Voice 使用单独的、按套餐计算的滚动五小时额度;通过 Voice 启动的 Codex 任务仍消耗 Codex 使用额度。
  • Voice 指挥的任务沿用对应任务的权限,不会绕过审批和沙箱。
  • macOS appshot 可能包含窗口图像、可访问文本,以及可滚动区域中当前没有显示的内容。不要让含密钥、客户数据或私密消息的窗口成为前台窗口。
  • 功能面向 ChatGPT Plus、Pro、Business、Edu 和 Enterprise 套餐,但实际可用性还受分批开放和工作区设置影响。

今天可以怎么用

先选一个低风险、可验证的任务试用,例如“运行测试并整理失败原因”。只在它能正确找到线程、复述阻塞并遵守“不修改”边界后,再把语音用于跨线程协调。高风险操作、合并决策和最终 diff 仍应回到可视界面确认。

参与下一次讨论