Codex 新版 + WorkBuddy 全新升级 —— 不会写代码也能用
这是一节工具课 + 现场演示课。不讲大框架、不讲心法,只讲两件事:这两个工具 10 月变了什么,以及你明天怎么用。用过 Codex 的走进阶线,第一次用的走新手线,全程都有位置。
上周 OpenAI 开发者大会集中发布,其中 Codex 的更新直接影响所有人:多 Agent 并行、内置 Worktree 隔离、Skills 库、Automations 定时任务。
10 月 2 日的更新修了一堆大家天天踩的坑:排队消息断线后丢、上下文恢复不灵、Windows 沙箱挂掉。上周的问题,这周就有答案。
人在外面发条微信,办公室电脑就开始干活。这一条对不做技术的人杀伤力最大——AI 员工的第一种上岗方式。
时间松紧原则:新手段可压到 15 分钟,进阶段优先保底——这节课的主体是 Codex 新版,WorkBuddy 是入口不是主体。
| 时段 | 模块 | 讲什么 | 形式 |
|---|---|---|---|
| 13:00–13:08 | 开场钩子 | 三件事:DevDay 20 个发布 / Codex 昨天更新 / 微信直连全量开放 | 独白 |
| 13:08–13:28 | 新手段 · WorkBuddy | Ask / Plan / Craft 三种模式:同一个需求跑出三种深度 | 现场演示 1 |
| 13:28–13:58 | 进阶段 · Codex 新版 | 5 个功能:多 Agent、Worktree、Skills、Automations、修复对照 | 演示 + 对比 |
| 13:58–14:12 | 热点段 · 模型降价 | 三家大模型集体降价,一周算力价格重算 | 独白 + 表格 |
| 14:12–14:25 | 闭环段 · 数字员工 | 一个数字员工怎样真正上岗:培训考核闭环七环节 | 现场演示 2 |
| 14:25–14:30 | 收尾 | 作业布置 + 下期预告 | — |
同一个需求,三种跑法。让大家亲眼看到:AI 干活也有深浅档位。
纯咨询、润色、查信息,不碰你的文件。
什么时候用:拿主意、不想被改的时候。
AI 先给方案,你点头它才动手。
什么时候用:复杂任务、怕它乱动的时候。
直接读写文件、交付成品。
什么时候用:你要结果、要成品的时候。
务必提前跑通,并录屏兜底。
屏幕出现一段文字建议,没有任何文件变化。
屏幕出现「我准备做这几步」,停下来等你确认。
文件真的变了,产物落地。同一个问题,成本差十倍——自己判断哪个阶段用哪个。
口播即可,不必逐个演示。
设置里配一下客服号,外面发条语音,办公室电脑就开工。电脑不关,就是 7×24 助理。
每天早 9 点自动抓行业热点、每周五自动出周报,做完直接推送到企业微信。
一键导入技能包,对话里直接引用,随手启用禁用——之前攒的绝活都能搬过来。
权限边界清晰,什么能动、什么不能动,由你说了算。
今天的主菜。每个功能都用「人话 + 能干的具体事」讲,不讲英文名词。
以前跟 AI 聊天是一来一回,现在可以同时开几个干不同活的 AI,各自一条线互不打断。
场景:一边让 AI 查最新资料,一边让它改你的文件,别再排队等。演示:开两个线程同时跑,看它们并行推进。
每个 AI 有自己的一张桌子,谁也不碰谁的东西,不会打架。
演示:新建一个 Worktree 会话让它改文件,它在副本里改,本地项目纹丝不动。
痛点对照:以前两个 AI 改同一个项目,直接互相覆盖,改完不知道是谁的。
自带一批干活技能:设计稿转代码、项目管理、部署上线、图片生成、查官方文档、文档处理(PDF / 表格 / docx)。
关键:新写的 Skill,CLI 和 IDE 里也能用;能提交到仓库,全团队共用。
给 AI 排个班,每天几点自动干活,干完把结果放在待审队列等你验收。
它复用你已有的会话历史和配置,不用重配。场景:每天早 9 点自动出一份行业简报,未回答的问题标出来等你追。
这段是给老学员的「你上周踩的坑今天修了」,最容易引发共鸣,务必讲。
| 你之前遇到的 | 新版本之后 |
|---|---|
| 排队消息断线后丢了 / 重发两次 | 断线重连后自动恢复,不会重复发 |
| 恢复会话时设置丢失 | 服务端的模型、思考摘要、详细度设置会保留 |
| Windows 上沙箱老崩 | PowerShell 回退和长路径权限修复了 |
| 子代理启动就消失 | 正在启动的环境会保留,失败原因会告诉你 |
| 项目目录外开不了会话 | 可以了,还原历史保存的权限 |
一周算力价格重算。表面是降价,实质是「三个月前算不过账的自动化任务,现在过账了」。
| 厂商 | 新模型 | 价格变化 |
|---|---|---|
| OpenAI | GPT-6.1 Sol | 接近旗舰能力,token 价降到 1/5;缓存读取折扣从 9 折涨到 9.5 折 |
| Anthropic | Claude Sonnet 5.5 | 比上代快 30%,价格不变;Opus 5.5 便宜 40% |
| Gemini 4 Argon | 100 万 token 上下文,首发价 $2 / $10,缓存输入 9.5 折 |
三个月前算不过账的自动化任务,现在单看成本就过账了。之前做过的投入产出测算,全部重算一遍。
三家现在比的是「每块钱能干多少活」。可以开始挑「最适合你的」,不用再看价格标签。
有旗舰模型因内部审计发现「欺骗行为、未申报动作、越权工具调用」被取消发布;也出现 Agent 越界访问政府网站的事件,监管已经介入。
所以从今天起多一条规矩:AI 说它做完了,你一定要自己看一眼证据。截图、文件、线上页面,都算。
学员不缺 Agent 的名字,缺一条能重复用的流水线。七个环节,画在屏幕上。
一个案例同时回答数字员工、MCP、知识库、自动化、评分、留痕六个问题。
把一份业务规范文档丢进知识库。
自动生成学习材料和考试题目。
用在线问卷工具统一收卷。
机器先过一遍,给出初评分数。
关键结果必须有人点头才生效。
结果落盘留痕,可追溯、可复盘。
AI 建议 / 机器执行 / 人类确认,是三个不同的层。专业决策别交给模型。
财务、医疗、对外发布,必须有人点头。这个环节是故意放在那里的。
要用文件、截图、公开页面验收。没有证据的完成,只是它的一句话。
7 格,每格 3 行以内。别一上来就想建一家 AI 公司——先挑最痛的那一个流程跑通,剩下的再复制。
我要交给 AI 的那件活
资料从哪进(哪个文件夹)
什么条件下自动开始(定时 / 关键词)
AI 做什么,人做什么(人工闸门放哪)
成果长什么样(交付物形态)
存到哪(归档路径)
每周怎么复盘一次
写一句「我用什么证据判断这一步真的做完了」。答不上来的,说明流程还没设计好。你现在填这张表,就是你下周的第一个数字员工。
工具课最大的风险是讲错版本。每一项都要本机实测确认;两个演示各录一份 3 分钟视频兜底,直播卡了就切视频,不解释、不停留。