1.1 Codex究竟是什么

本节介绍Codex究竟是什么,并说明需要关注的操作、边界和验收方法。

从一个多文件汇总任务说起

先看一个常见场景。

你手里有6份会议记录、1份项目计划,以及3份从企业微信聊天记录中整理出的相关对话。领导希望你在今天下班前出一个方案,列出事项、负责人、截止时间、风险和待确认问题。

如果使用普通对话AI,你可能会逐个上传材料,请它总结,再把几次回答复制粘贴再让AI合并。这么做麻烦不说,材料一多,还容易出现版本混淆、遗漏和重复。

如果使用Codex,就容易多了,你可以把这些材料放进一个文件夹,然后直接说明:

阅读文件夹中的会议记录、项目计划和聊天记录,生成一个方案。每一项必须包含事项、负责人、截止时间、原始出处和待确认问题。不要修改原文件;信息冲突时不要猜测,单独列入“待确认事项”。完成后检查是否覆盖了全部10份材料。

Codex会先读取材料,再按你的要求生成方案。材料数量、格式和任务复杂度都会影响处理时间。如果方案哪里不满意,你还可以追问,让Codex继续改。中间如果你发现还需要补充一些资料,可以直接将新文件放到文件夹中,然后告诉Codex:

根据新增的文件,修改方案。

从“生成回答”到“完成任务”

Codex是一种智能体(Agent),可以把它理解为“能够围绕任务目标连续采取行动的AI执行者”。它不只是生成文字,还可以在得到授权后完成一个工作流程:

  1. 阅读指定材料,理解当前状态;
  2. 制订计划,决定先做什么、后做什么;
  3. 调用可用工具,读取、创建或修改文件;
  4. 检查输出,发现问题后继续修正;
  5. 汇报做了什么、结果在哪里、还有什么未解决。

这也是Codex与“问一句、答一句”的聊天体验最重要的区别。我们日常实际的工作通常不是一次回答,而是多步执行:先整理,再核对;先生成,再测试;发现错误后,还要回到材料中定位原因。

Codex的3个组成部分

Codex能把任务推进下去,主要靠3个部分协同工作,具体见 表 1

表 1: Codex的三个组成部分
组成部分 用普通语言理解 对你的影响
模型 负责理解、推理和生成内容的“大脑” 决定它能否理解复杂任务,但不能单独保证结果正确
工具 读取文件、处理表格、运行检查或访问外部服务的“手和眼睛” 决定它实际能做什么,也决定可能影响哪些数据
工作区与规则 工作时所在的“工位”与必须遵守的“规矩” 决定它能在哪个文件夹干活、可以改动哪些文件,以及何时必须向你请示

Codex看见的世界来自你提供的上下文

Codex不会自动知道你公司的缩写、某一列数据的含义、领导偏好的汇报格式,也不会天然知道哪份文件是最新版。你需要通过以下方式提供上下文:

  • 指定工作文件夹和材料范围;
  • 说明业务背景、字段含义和内部术语;
  • 提供已有模板、合格样例和错误样例;
  • 写清哪些内容是事实源,哪些只是参考;
  • 标明不能读取、不能修改或不能外发的内容。

上下文不是越多越好。材料太多、版本混杂或重点不清时,Codex也可能遗漏重要信息。更稳妥的做法,是先给它与当前任务直接相关的材料,再在发现缺口时补充。

上下文也不都需要你手工整理。Codex自带联网搜索能力,能主动查找完成任务所需的公开信息。是否访问网络、能访问哪些来源,要以界面权限和公司规定为准;涉及关键结论时,仍要检查来源和日期。

搞清楚了Codex是如何帮我们推进工作的,你可能还会好奇:市面上现在有那么多AI办公工具,它们和Codex究竟有什么不同?我们接着看下一节。

回到顶部