Codex 5月更新5大功能解析
大家好,我是苍一,一个干了13年的后端开发,正在探索AI编程,从产品到开发的全生命周期最佳实践,如果您感兴趣,欢迎关注👇,看我如何自我革命。
背景
OpenAI 在 5 月 21 日发布了一波 Codex 更新,包括 Appshots、Goal mode、浏览器批注、locked computer use、browser use improvements 五个方向。这五个功能指向的是同一件事:Codex 正在从代码补全工具变成一个可以独立跑任务的 AI 工位。
Appshots:让 AI 看到你的屏幕
用 AI 修前端 bug 时,最耗时的部分往往不是改代码本身,而是描述问题。你得写"右上角那个蓝色按钮往下挪两个像素"这类话,写得累,AI 理解得也累。
Appshots 的做法很直接:在 Mac 上把当前应用窗口的状态打包发给 Codex,内容包括窗口截图和可读取的文本内容。Codex 收到的不只是代码文件,而是你此刻正在面对的整个工作界面。
这对前端开发、桌面应用调试、配置面板调整的场景帮助最大。AI 不是能力不够,而是缺乏上下文。Appshots 本质上是在补上下文。
Goal mode:定义结果,而不是描述过程
这是这次更新里最值得重视的功能。
以前给 AI 派任务,常见的说法是"帮我把这个页面优化一下"。这种指令的问题在于没有完成标准。AI 改了一版你说不对,再改一版你又说不行,循环几次双方都很疲惫。
Goal mode 让你在下达任务时同时定义验收条件:
• 把项目迁移到 TypeScript,要求 strict 模式编译通过,不允许出现显式 any
• 修复移动端布局问题,375px 宽度下所有按钮不能溢出屏幕
• 重构用户模块,要求所有公开方法有单元测试,覆盖率不低于 80%
这不是闲聊式地让 AI 帮忙,而是像给团队成员派活一样,说清楚要什么结果、怎么算完成。AI 编程工具发展到现阶段,竞争重点已经不是谁的模型更聪明,而是谁能更好地把人类意图转化为可执行的、有验收标准的任务。
浏览器批注:用视觉代替文字描述
做前端的人都知道,用纯文字描述视觉问题有多低效。"这个卡片看起来不太对"可能指高度、间距、圆角、阴影、字体大小,AI 只能猜。
这次更新允许你在 Codex 内置浏览器里直接打开页面,用标注工具圈出需要修改的区域,然后让 AI 针对性地调整。同时 browser use 也有一系列改进:高级批注模式、更快的静态资源提取、只读 JavaScript 执行上下文、标签页分组。
第一版代码生成通常很快,真正的耗时在后续的视觉微调。批注功能直接缩短了这个循环。
锁屏执行:支持更长的任务链
Mac 锁屏之后,在用户授权的前提下,Codex 可以通过 Computer Use 继续执行当前任务。这不是通用远程解锁,而是仅限于 Codex 正在处理的任务的受限能力。
AI 工具之前有一个隐性限制:它像一个需要你盯着才干活的实习生。你离开电脑,任务就停了。锁屏执行配合手机端的审批功能,意味着你可以让 Codex 跑一个较长的任务链,中途需要确认时推送到你手机上批准。
这改变了 AI 编程工具的使用模式。以前是用一段写一段,现在可以安排一串任务让它自己跑,你只需要在关键节点介入。
手机端与 host 的分工
5 月 14 日的移动端预览加上 5 月 21 日这波更新,整个架构的分工变得清晰了。
手机不是另一个 IDE,它是一个远程控制面板。真正执行任务的是 host:你的 MacBook、Mac mini 或者云端 devbox。手机上做的是三件事:监督进度、审批操作、纠正方向。
跟传统远程桌面的区别在于,远程桌面是你直接操作电脑,而 Codex 的模式是 AI 在电脑上干活,你在手机上管它。主动方从人变成了 AI,人变成了监督者。
总结
这五个功能分别对应了 AI 工位需要的五个能力:Appshots 补上下文感知,Goal mode 补任务定义和验收,浏览器批注补视觉沟通,锁屏执行补长任务持续性,手机审批补远程监督。
真正的分水岭不在于你用不用 Codex,而在于你怎么用它。把它当聊天框,它就是聊天框。把它当一个可以派活、可以验收、可以远程管理的 AI 工位,它才能开始真正替你分担工作。关键在于你有没有建立起一套任务分配和验收的流程:哪些任务适合交给 AI 跑,验收条件怎么写,哪些操作可以自动批准,哪些节点必须人工确认。这套流程才是工具之上真正产生价值的东西。
如果嫌文章太长、怕后面走丢,可以关注下面的ima知识号,让这篇文章成为你的知识顾问,随时随地等候你的提问。
知识号中内容会以笔记形式分享,可以根据大家反馈和实测情况,实时更新,保证最新方案的稳定、可用。
【ima 知识库】

更多推荐


所有评论(0)