CODEX · WORKFLOW INDEX

从工作场景出发,找到可复用的 Codex 工作流

300 条工作流覆盖研发、产品、数据、运营、销售、市场、财务与专业服务。每条都说明适用场景、执行方式、使用案例与原始来源。

一条可复用工作流的组成300 / SOURCED
01
准备上下文文件、数据与权限
02
交给 Codex明确任务与产物
03
人工验收核对事实与边界
04
沉淀复用技能、模板或自动化
从相似场景开始,再替换成你的真实上下文
300工作流
12工作类别
11职业岗位
42原始来源

从相似任务出发,保留流程结构,再替换成你的真实上下文与验收标准。

全部类别

300 条匹配工作流

WF01
公共服务与教育A1

GroundVue:把分散的政府会议变成可检索知识库

创始人、公共政策研究员政务科技

适用场景

约 9 万个政府机构的会议资料散落在视频、地方网站和不同平台中。传统研究需要技术人员和研究员手工寻找、下载、整理,单个任务可能耗时数天或数周。

工作流说明

让 Codex 寻找难以触达的公开来源,再构建持续采集、标准化和组织资料的系统;最终目标不是写一段摘要,而是把异构公开信息沉淀成可搜索、可比较的数据资产。

使用案例与边界

官方报告称相关任务由“数天或数周”缩短到“数分钟”,小团队得以完成过去需要较大技术与研究团队承担的工作。资料仍来自公开来源,结果质量取决于源站可用性和采集覆盖率。

WF02
公共服务与教育A2

Proaction:把客户访谈直接推进到可运行演示

联合创始人、解决方案工程师车队管理 SaaS

适用场景

潜在客户的车辆与设备数据分散在车联网系统、维修平台、电子表格和员工经验中。通用销售材料无法证明方案能适配每个客户的实际运营。

工作流说明

联合创始人 Colin Knudsen 把客户对话交给 Codex,生成定制提案、工作流原型和能运行的演示;在签约前就用客户场景验证方案,把客户发现、售前和产品开发接成一条链。

使用案例与边界

五人团队能更快地做定制验证并与更大公司竞争。来源未披露具体节省时长,不能把“更快”进一步量化。

WF03
公共服务与教育A1

数学教授:自动维护 Canvas 课程信息

教师高等教育

适用场景

每周都要在 Canvas 学习管理系统中手工维护作业、日历、材料和公告,行政操作挤占了备课与面对面教学时间。

工作流说明

由 Codex 协助生成脚本,批量更新课程的四类信息;教师保留课程内容和发布时间的控制权,把重复录入交给自动化脚本。

使用案例与边界

Inoue 估计每周节省 4-5 小时,并把时间用于重新设计协作式解题课堂。案例证明的是课程信息维护,不是让 Codex替代教学判断或评分。

WF04
公共服务与教育A2

Luke Xing:为单侧听力损失构建个人音频补偿应用

非专业开发者无障碍与个人音频

适用场景

Luke 左耳存在显著且随频率变化的听力损失,现成商业软件不能满足他在音乐、通话和日常听音中的平衡需求。

工作流说明

他用自然语言描述问题,让 Codex 构建桌面应用;应用测试不同频率的听力响应,并针对不同输出设备调整音频,尝试恢复左右平衡。

使用案例与边界

形成了可实际使用的个人工具,但报告明确说明它不是医疗器械。该案例不能外推为听力诊断或治疗方案。

WF05
财税与专业服务A1

Crete:从数百万份底层文档起草 1040/1041 报税表

报税从业者税务会计

适用场景

事务所每个报税季要处理数万份申报和数百万份文档。中高复杂度报税仅数据录入就可能耗时 8 小时,还要核对客户备注、往年文件和杂乱来源。

工作流说明

从业者上传源文件和客户备注,Tax AI 提取、计算并生成可审查的税务引擎提交结果;先覆盖 W-2、1099,再扩展到 K-1、附表和跨文档核对。

使用案例与边界

试点处理 7,000 份报税表,起草准确率最高 97%,平均节省约三分之一准备时间,吞吐量提升约 50%。最终申报仍由税务从业者审查批准。

WF06
财税与专业服务A1

Crete 产品团队:把“公平出租天数”漏填变成自动改进任务

税务产品工程师税务软件

适用场景

Schedule E 租赁房产数据来自手写备注、邮件、表格等混乱材料。系统漏填字段时,从业者能修正,但早期产品没有保留从源文件到最终申报的完整证据链。

工作流说明

记录 Tax AI 预测、从业者修改和最终申报;把重复差异聚类成产品失败;为“公平出租天数”等问题构建定向评测集。Codex 联合检查生产追踪、提取 schema、mapper、代码和 skills,实施修复,跑定向与回归评测,再提交候选 PR。

使用案例与边界

75% 字段正确完成率的报税表占比从上线时约 25% 在 6 周内升到 86%;租赁房产场景约 6 周达到 90% 精确率和召回率。证据含糊或涉及税务判断的案例会回到产品团队,而不是自动上线。

WF07
财税与专业服务A1

资深会计师:把报税准备时间转成客户解释与新增服务

资深会计师税务会计

适用场景

报税季大量时间消耗在资料录入和准备,几乎没有余力逐项向客户解释申报,也难以承接新增业务。

工作流说明

沿用 Tax AI 的文档提取、税务引擎映射和人工复核流程,让系统承担可自动化的准备工作;会计师将人类时间放在解释、判断和关系维护上。

使用案例与边界

该会计师上一年花 180 小时做报税准备,本年度只花 15 小时;她给每位客户打电话逐项讲解报税表,并用剩余时间接新客户、拓展服务。指标是单个从业者实例,不能视为所有事务所的平均值。

WF08
数据与产品研究A1

OpenAI 内部数据智能体:自然语言完成端到端分析

数据分析师、业务人员企业数据平台

适用场景

3,500 多名内部用户面对 70,000 个数据集和 600 PB 以上数据,找对表、写对连接和筛选往往比分析本身更耗时,单条 SQL 可超过 180 行。

工作流说明

用户用自然语言提出开放问题,例如找出纽约出租车上下车 ZIP 组合中“典型耗时与最差耗时差距最大”的路线及波动时段;智能体自行发现数据、运行 SQL、发现零行或异常连接后改路、生成图表、笔记和报告。

使用案例与边界

从提出问题到获得洞察由“数天”缩短到“数分钟”。系统继承用户原有表权限,并提供假设、执行步骤和底层结果链接供复核。

WF09
数据与产品研究A2

数据平台工程师:让 Codex 从生产代码推导表语义

数据平台工程师企业数据治理

适用场景

schema 和历史 SQL 只能说明表的形状与使用方式,无法可靠说明数据为何这样生成、更新频率、粒度、排除范围和业务意图。

工作流说明

Codex 爬取数据生产代码,推导表的代码级定义;补充唯一性、刷新频率、范围以及 Spark/Python 中的使用上下文。每日离线流水线把使用情况、人工注释和 Codex 增强信息归一化、嵌入并供检索。

使用案例与边界

智能体能区分名字相似但口径不同的表,例如是否只含第一方 ChatGPT 流量;上下文自动刷新,减少人工维护。最终定义仍要接受领域专家注释和实时数据验证。

WF10
数据与产品研究A2

财务与业务运营:把周报和表校验封装成可复用工作流

财务、业务运营财务与经营分析

适用场景

用户会周期性重复同样的分析,容易反复找表、重写查询、遗漏固定口径,也让不同人员生成的周报难以保持一致。

工作流说明

把 recurring analysis 封装成 workflows,即带上下文和最佳实践的可复用指令集;官方列出的实际示例包括每周业务报告和表验证。

使用案例与边界

重复分析的准备步骤被压缩,且不同用户可共享一致流程。来源未披露周报耗时或错误率的量化变化。

WF11
数据与产品研究A2

数据科学家:用“记忆”保存特殊实验筛选规则

数据科学家实验分析

适用场景

某些实验需要匹配实验门中定义的特殊字符串;通用 schema 无法推断这类组织特有规则,智能体容易反复尝试错误的字符串筛选。

工作流说明

用户纠正后,智能体提示保存记忆;记忆可分全局和个人范围,保存不明显但决定正确性的过滤条件与约束,后续查询从正确基线开始。

使用案例与边界

避免每次重新解释同一实验规则。用户可以创建和编辑记忆;错误记忆也会污染后续结果,因此仍需可见、可改和有权限范围。

WF12
数据与产品研究A1

Braintrust:客户功能请求几分钟变成预览分支

产品工程师AI 开发工具

适用场景

过去客户功能请求先进入 backlog,再排优先级,客户要等到后续周期才看到方案,产品反馈循环很慢。

工作流说明

团队把客户请求复制给 Codex,让它修改产品并创建 preview branch;在客户仍参与讨论时就展示可运行版本,继续围绕实际界面迭代。

使用案例与边界

官方称从请求到可展示预览只需几分钟;一个月内 50% 的 Braintrust 团队转向使用 Codex。预览分支用于验证,不等于未经审查直接发布生产。