跳到主要内容

你真的会用 Codex 吗?

用 15 道选择题,检验你对上下文、工具、权限与验证流程的理解。

15道聚焦问题
4个知识维度
1个清晰等级

好结果从提示词之前开始

测评关注真正影响交付质量的操作习惯,让 Codex 从代码生成器变成可靠的工程协作者。

上下文

向 Codex 提供正确的文件、约束和完成标准。

识别上下文缺失如何让看似完整的输出变得不可靠。

AGENTS.md

把稳定的仓库规则写在它所约束的代码附近。

理解不同目录范围的指令如何持续影响任务执行。

工具与权限

根据任务的真实风险配置工具访问和审批边界。

区分只读探索与会修改文件或外部系统的操作。

测试与人工复核

把生成的修改视为仍需证据和判断的方案。

选择聚焦测试、检查差异,并由人对最终决定负责。

先试一道题

选出最可靠的工作流,再查看背后的判断依据。

Codex 提议修改认证逻辑并新增一个依赖。合并前最可靠的下一步是什么?
单选题

从会提问到会做工程

等级描述的是你能否稳定应用这些习惯,不代表速度,也不等同于资历。

入门

你能界定一个范围清晰的任务,并检查直接结果。

  • 说明期望结果
  • 提供相关文件或错误
  • 阅读生成的代码差异

熟练

你能用仓库上下文引导 Codex,并选择有效的检查。

  • 补充约束和验收标准
  • 用 AGENTS.md 固化指导
  • 运行聚焦验证

进阶

你能委派多步工作,同时控制风险和反馈循环。

  • 限定工具和权限范围
  • 把工作拆成可复核的修改
  • 根据测试证据调整方案

专家

你能设计可复用的 Codex 工作流,改善团队的工程系统。

  • 建立清晰的仓库规范
  • 让验证深度匹配风险
  • 由人承担最终责任

下一次任务就能用上的结果

测评把模糊的自信转化为明确的学习优先级。

找到能力基线

看清哪些操作习惯已经可靠,哪些仍然依赖猜测。

识别真正缺口

区分提示词问题与上下文、权限和验证问题。

有目标地提升

根据等级说明选择下一项重点练习,而不是继续收集零散技巧。

开始前的常见问题

了解测评内容、答题方式以及结果代表什么。

测试包含哪些内容?

测试覆盖上下文设计、AGENTS.md 指令、工具与权限选择、测试和人工复核。它关注你如何与 Codex 协作,而不是编程语言语法。

题型是什么?

测试包含 15 道单选题。每道题都会给出一个真实的 Codex 使用情景,请你选出最可靠的行动或工作流。

测试结果有什么用?

你可以把结果作为学习基线。等级会指出能力特征和值得练习的方向,但它不是职业认证,也不是招聘评分。

测试内容根据什么更新?

题目会参考 OpenAI 公开发布的实践指南和 Codex CLI 文档进行复核,并在公开工作流与控制方式变化时更新。

这是 OpenAI 官方产品吗?

不是。Codex Level 是独立社区项目,与 OpenAI 没有隶属关系,也不代表 OpenAI 的认可或运营。

把直觉变成清晰的能力基线

十五道题,看清你现在如何与 Codex 一起工作。

开始测试