6 级能力阶梯
从「把 AI 当搜索引擎」到「设计人机协作系统」,能力差距不在提示词技巧,而在判断与流程。
L1AI 操作员
会提问,但主要把 AI 当搜索引擎使用。
总分 ≥ 0
L2AI 协作者
能给上下文并多轮迭代,验证意识仍不稳定。
总分 ≥ 36
L3AI 判断者
能分辨事实与推断,会主动要求证据。
总分 ≥ 50
L4AI 工作流设计者
能把任务拆解、委派并定义验收标准。
总分 ≥ 63
L5AI 原生工作者
默认以 AI 为核心重构自己的工作方式。
总分 ≥ 75
L6AI 系统架构者
能设计可复用的人机协作系统与质量机制。
总分 ≥ 87
测的是能力,不是知识点
问题重构
面对一句模糊需求,你会直接转发给 AI,还是先把它变成可回答的问题?
真假验证
一段混合了正确事实、无来源数字与错误推断的回答,你能分辨到哪一层?
开放任务
有限时间与预算下,你能否设计出可执行、可验证、可复用的 AI 协作方案?