跳到主要内容

你有多会用 Codex 完成工作?

用 15 道题,检验你如何表达任务、运用信息与工具、控制风险并复核结果。

15道聚焦问题
5个能力维度
1个清晰等级

好结果不只需要一句好提示词

测评沿着任务的完整生命周期展开,从第一次提出需求,到获得可以信任、使用和分享的成果。

任务表达

把想法转化为目标清晰、边界合理并带有成功标准的任务。

选择合适的协作方式,让下一步行动没有歧义。

上下文与信息

提供塑造成果所需的信息、参考资料与约束。

区分权威来源与假设,并让变化中的上下文保持准确。

工具与执行

运用合适的连接工具与工作流,把回答推进为真正的成果。

协调文档、数据、演示、应用、网站与轻量工具。

安全与控制

让访问范围、审批要求与外部操作匹配任务的真实风险。

保护敏感信息、确认目标,并由人掌握关键决策。

验证与迭代

检查工作、根据证据调整,并在交付前持续改善成果。

核验主张与计算、补齐缺口,让反馈成为工作流的一部分。

先试一道题

选出最可靠的下一步,再查看背后的判断依据。

Codex 已经生成一份准备对外分享的报告。此时最可靠的下一步是什么?
单选题

从提出需求到获得可信成果

等级描述的是你能否在不同任务中稳定应用这些习惯,不代表速度、职位或资历。

入门

你能描述一个聚焦的任务,并检查直接结果。

  • 说明期望结果
  • 提供最相关的信息
  • 使用结果前主动复核

熟练

你能用有效上下文引导 Codex,并选择适合任务的检查。

  • 补充约束和验收标准
  • 区分信息来源与假设
  • 进行聚焦验证

进阶

你能委派多步工作,同时控制风险和反馈循环。

  • 限定工具和权限范围
  • 把工作拆成可复核的阶段
  • 根据证据与反馈调整方案

专家

你能设计可复用的 Codex 工作流,改善团队把想法转化为成果的方式。

  • 建立清晰的协作规范
  • 让验证深度匹配风险
  • 由人承担最终责任

看清 Codex 能如何增强你的工作

测评把可迁移的协作习惯,与每个人都可能需要的真实成果连接起来。

研究与报告

把分散信息转化为有来源的研究、清晰摘要,以及经过审慎复核的报告。

数据与演示

分析数据、检查计算,并把发现整理为实用的表格、图表和演示文稿。

跨工具执行

协调连接的应用与可复用工作流,并在任务需要时创建网站或轻量工具。

开始前的常见问题

了解测评内容、答题方式以及结果代表什么。

测试包含哪些内容?

测试覆盖任务表达、上下文与信息、工具与执行、安全与控制、验证与迭代。题目关注可迁移的判断,而不是某个专业领域的冷知识。

题型是什么?

每次会从 75 道题中随机抽取 15 道,包括 10 道单选和 5 道多选。多选题可以获得部分分,但错误选择会扣减部分分。

测试结果有什么用?

你可以把结果作为学习基线。等级会指出能力特征和值得练习的方向,但它不是职业认证,也不是招聘评分。

测试内容根据什么更新?

题目会参考 OpenAI 公开发布的指南进行复核,并在 Codex 公开能力、工作流与控制方式变化时更新。

这是 OpenAI 官方产品吗?

不是。Codex Level 是独立社区项目,与 OpenAI 没有隶属关系,也不代表 OpenAI 的认可或运营。

把日常经验变成清晰的能力基线

十五道题,看清你如何与 Codex 一起把需求推进为经过复核的成果。

开始测试