很多人第一次打开 Codex,会下意识问一句:“我又不写代码,这东西对我有什么用?”
这个问题很正常。Codex 的界面不像办公软件,没有一个写着“生成周报”或“整理文件”的大按钮。它更像一个能看文件、跑工具、操作网页并持续干活的执行者。能力很宽,入口反而不明显。
我的建议是,别先研究所有功能。先从一件低风险、结果容易检查的杂活开始。
第一类:把电脑上的脏活交出去
软件安装失败、环境变量混乱、某个命令找不到、下载目录堆了几百个文件,这些事情不难,却很耗耐心。
Codex 很适合先检查现状,再给出方案,经过确认后执行。比如按文件类型和日期整理目录、找出重复文件、生成清单,或者诊断某个工具为什么启动失败。
第一次用时,最好限定目录,并明确“先预览,不删除”。
第二类:读一堆材料,留下能用的结果
会议录音转写、几十页 PDF、项目群里的零散记录,都可以交给它整理。
但“总结一下”通常不是好任务。更好的说法是:提取结论、责任人、截止时间、争议点和待确认事项,无法从材料确认的内容单独列出,不要补写。
结果从一篇漂亮摘要,变成可以继续推进工作的清单。
第三类:处理表格和重复数据
合并多个 Excel、统一字段、检查异常值、按规则分类、生成透视分析,这类工作通常步骤明确,也容易验收。
先让它输出处理规则和异常样例,再写入新文件,不覆盖原表。这样即使判断错了,也有回头路。
第四类:做 PPT 的第一版
Codex 可以根据材料搭结构、写每页要点、找数据、制作图表,再生成可编辑的文件。
真正省时间的不是让它“做一份高级 PPT”,而是把受众、演讲时长、结论和必须保留的数据交代清楚。第一版做出来以后,人负责删减和定调。
第五类:做带证据的网页调研
查产品价格、比较服务条款、核对一条新闻、整理竞品功能,都适合交给它。
要求必须写清:优先看官方网站和原始资料,记录发布日期,事实与推断分开,找不到就说找不到。
这比让模型凭记忆给答案可靠得多。
第六类:替你操作浏览器和桌面软件
批量录入、重复下载、跨页面复制信息、在后台按固定规则配置内容,都是典型的“人会做,但不想一直做”。
涉及发送、付款、删除和公开发布时,应该保留最后一步人工确认。自动化不是取消责任,而是把注意力留给真正需要判断的动作。
第七类:维护项目的外部记忆
一个项目做久了,最容易丢的不是文件,而是决定。
为什么当时选了这个方案?哪些坑已经踩过?下次继续时从哪里开始?让 Codex 持续维护变更日志、决策记录和下一步清单,能减少每次重新理解上下文的成本。
第八类:把稳定做法变成 Skill
一件事重复三次以后,就值得考虑固化。
比如每周把数据库资讯整理成候选选题,或者把 Markdown 排成固定的公众号样式。先手工跑通几次,确认输入、输出和检查规则,再做成 Skill。不要一开始就自动化一个还没想明白的流程。
第九类:持续监测,而不是临时搜索
某个产品发布新版本、一个政策页面发生变化、数据库出现安全通告,临时想起来再查往往已经晚了。
Codex 可以按固定频率检查,只有变化时才提醒,并附上来源和差异。这里的关键是把“什么变化值得打扰我”定义清楚。
第十类:完成一段可以验收的工作
前九类看起来不同,其实有同一条规律:材料明确、步骤可执行、结果可检查。
一个好任务至少应包含四件事:在哪里做,允许做什么,最终交付什么,怎样算完成。
例如:“检查下载目录中最近 30 天的 PDF,按主题建议分类;先生成移动清单,不执行移动;重复文件只标记,不删除。”
这样的任务,模型更容易做对,人也更容易验收。
Codex 最值得用的地方,不是陪你多聊几句,而是把那些原本会吞掉半天时间的任务,变成一段有边界、有结果的执行过程。
先交出去一件小事。等它做对,再把下一件交出去。