Codex 上手机以后,真正重要的不是“手机能写代码”:而是 Agent 的人类介入点被重新设计了
AH-0174抓对了一个核心方向:长时间运行的Agent真正的瓶颈,经常不是模型不会做,而是它在某个决策点等人。 2026年5月14日,OpenAI官方宣布 Codex 进入 ChatGPT iOS/Android 移动应用预览。手机端可以查看活跃线程、输出、终端、diff、测试结果,回答问题、改变方向、批准下一步,工作仍运行在连接的机器或远程环境中。 所以“手机不是编辑器,而是介入面板”这个判断
Codex 上手机以后,真正重要的不是“手机能写代码”:而是 Agent 的人类介入点被重新设计了
AH-0174抓对了一个核心方向:长时间运行的Agent真正的瓶颈,经常不是模型不会做,而是它在某个决策点等人。
2026年5月14日,OpenAI官方宣布 Codex 进入 ChatGPT iOS/Android 移动应用预览。手机端可以查看活跃线程、输出、终端、diff、测试结果,回答问题、改变方向、批准下一步,工作仍运行在连接的机器或远程环境中。
所以“手机不是编辑器,而是介入面板”这个判断基本成立。
但源文仍然有几处需要更新。
1. Windows“还在路上”已经过时
源文发布时写:
“桌面端Mac现在可以,Windows版本在路上。”
截至2026-08-14,这已经过时。
OpenAI在2026年3月4日就已经更新:Codex app 可用于 Windows。
不过移动远程连接到 Windows 主机的支持,在5月14日官方公告里仍处于“coming soon”。
因此必须拆开:
Windows Codex App availability 和 Mobile Remote Connection to Windows host
不是同一件事。
2. 手机端的价值不是“任务不会停”
这是源文最容易被误读的地方。
手机端不会神奇地消灭阻塞。
如果主机睡眠、断网、权限不足、任务需要复杂判断、项目环境坏了,任务仍然可能停。
OpenAI官方写得更准确:
手机让你能够在关键时刻介入。
这意味着真正要设计的是:
Intervention Protocol
而不是“无人值守神话”。
3. Start Confirmation:离开电脑前先确认任务真的进入可运行状态
这个细节非常好,应该保留并产品化。
离开前检查:
- Host online
- Correct project
- Required permissions
- Task started
- Dependencies ready
- Tests/build available
- Notification enabled
如果其中任何一个缺失,所谓“远程工作流”可能只是远程看到它卡住。
4. Decision Rights:什么能在手机上拍板?
源文说“手机只做轻决策”,这是本篇最成熟的一条。
我把它进一步拆成三级:
L1 — Mobile Safe
- 路径确认
- 是否继续读取
- 低风险方向选择
- 查看日志
- 补一句上下文
L2 — Review Required
- 大范围代码改动
- 删除/覆盖文件
- 依赖升级
- 生产配置
- 涉及密钥
手机可以看到,但应先看diff和影响面。
L3 — Desktop / Human Gate
- 发布生产
- 大规模迁移
- 安全策略变更
- 高风险数据处理
- 不可逆动作
“能点批准”不等于“适合在走路时批准”。
5. Notification Budget:不是所有Agent问题都值得把你叫回来
Agent越多,通知越容易变成新的人肉队列。
所以移动Agent工作流需要:
Silent 正常执行,不通知。
Digest 完成后汇总。
Need Input 缺必要信息。
Approval 需要明确授权。
Critical 可能造成高影响结果。
如果所有动作都推手机,你没有从执行里解放,只是把桌面监工变成口袋监工。
6. 远程Agent的核心指标:Human Blocking Time
不要只测“Agent跑了多久”。
真正应该测:
Total Task Time 从派发到完成。
Agent Active Time Agent实际执行。
Human Blocking Time 因为等你而停了多久。
Review Time 最终人工复核。
Rework Time 因为错误返工。
Intervention Count 需要人介入几次。
移动端真正可能降低的,是 Human Blocking Time。
如果介入次数越来越多,说明任务合同、权限、环境或Agent能力本身有问题。
7. 手机端不是让复杂工作变碎片化
源文的一个风险是容易让人产生“任何时候都应该看看Agent”的感觉。
这会破坏深度工作。
好的规则反而是:
手机只处理让工作继续所需的最小决策。
复杂审核留到大屏。
新想法先记录,不必马上改整个任务方向。
真正重要的策略判断不要被通知驱动。
8. 安全:远程执行必须比聊天更严格
OpenAI关于Codex安全部署的公开说明强调:
- 权限边界;
- 高风险动作显式批准;
- 可审计遥测;
- 限制Agent访问范围。
移动端更方便批准,因此更需要减少“顺手点允许”。
所以每个长期任务应有:
Allowed Scope 能访问什么。
Approval Threshold 哪些必须人批。
Audit 做了什么。
Recovery 误操作怎么回退。
网站资产:Agent Intervention Protocol Lab
本批实际生成 agent_intervention_protocol_lab.html。
输入:
Host / Start / Notification / Decision Rights / Approval Threshold / Human Blocking / Review / Recovery。
输出:
READY TO LEAVE DESK / TOO MANY HUMAN BLOCKS / APPROVAL RISK / HOST DEPENDENCY / REVIEW DEBT
Codex上手机以后,真正值得普通人学会的不是“随时随地工作”。
而是:
> 什么时候不该打扰你,什么时候必须叫你回来。