过去三十年,企业把「评估」默认交给岗位说明书:JD 写清楚要什么,简历和面试照着比对,职级和薪酬再按岗位锚定。AI 进来之后,这一套的前提开始松动。当 AI 能替你写、替你分析、替你出初稿,岗位说明书里那些「会写报告、能做分析」的要求,瞬间变成了「会用工具的人都能做到」的基线能力。评估的对象变了,但大多数企业的评估系统还没动。
招聘正在重写评估规则
Gartner 在 2026 及未来战略预测中给出两个时间点:到 2027 年,75% 的招聘流程会在录用环节加入职场 AI 能力认证与测试;到 2026 年底,因生成式 AI 导致批判性思维退化,全球 50% 的组织会要求做「无 AI」技能评估。同组预测还提到,到 2027 年生成式 AI 与智能体将首次真正挑战主流生产力工具,引发约 580 亿美元的市场重构——评估工具本身也在被重写。
这两件事合在一起,含义很清楚:评估的标尺从「你有什么经验」转向「你能不能和 AI 协作,以及你能不能在 AI 之外独立判断」。前者考的是工具使用,后者考的是人类判断。过去我们用一份面试覆盖两者,现在它们正在被拆开。
但大多数组织连「要测什么」都还没想清楚。BCG 与 WFPMA 联合发布的《Creating People Advantage 2026》(覆盖 115 个市场、7,000 多名 HR 与业务领导者)显示:近 70% 的组织已在用生成式 AI,但只有 38% 认为它对组织高度相关;更关键的是,仅 11% 的组织建立了企业级技能图谱。也就是说,绝大多数公司在「评估什么」这件事上,连一份可命名的清单都没有。
能力清单还停在岗位时代
当评估拆成两半,第一半(AI 能力)相对好测:标准化测评、实操任务、提示词工程都能上。难点在第二半——「无 AI」评估测的是独立判断、证据评估、在不确定中做决定的能力,这些恰恰最难量化,也最容易被跳过。
BCG 的数据把这个矛盾摆得很直白:只有 54% 的组织做技能匹配,48% 有结构化的再培训项目,但企业级技能图谱的渗透率只有 11%。没有图谱,无 AI 评估就只能退化为「凭感觉的面谈」——考官自己也说不清到底在测什么。这解释了为什么很多组织在 AI 时代招人越来越像赌博:岗位说明书写的是昨天的技能,评估流程考的是工具使用,真正稀缺的独立判断反而没被测到。
评估权的分裂,本质是判断权的重新定价。当 AI 接管了产出,企业之间比的不是「谁用 AI」,而是「谁还能在 AI 之外做对判断」。
双轨评估:用 AI,也能离开 AI
双轨评估的定义很直接。轨道一,验证 AI 流利度——看候选人会不会把 AI 当协作者,而不只是当搜索引擎;会不会拆解任务、校验产出、把 AI 的结果接进真实工作流。轨道二,保护独立人类判断——给一个没有 AI 的任务,看候选人能否独立推理、识别证据、承担判断并说清取舍。
微软 2026 工作趋势指数(WTI)提供了一个关键注脚:86% 的知识工作者把 AI 产出视为「起点」而非「成品」。这恰恰说明,价值的后半段在人类判断。同一指数显示,58% 的用户已经在做一年前还做不到的工作——AI 把基线抬高了,但把「判断往哪里用」留给了人。
但判断权不会自动保留。Gartner 的「无 AI 评估」预测,本质是对「批判性思维因过度依赖生成式 AI 而退化」的防御。组织若不主动测、不主动练,判断能力会像肌肉一样 atrophy。这也是为什么双轨里第二轨既要「可测」,更要「可练」。
HR 一号位的评估重构动作
把「评估拆两半」从趋势变成机制,HR 一号位至少有三个动作可以立刻启动,不需要等全员转型:
- 把能力图谱从 PPT 落到系统。 参考 BCG 那 11%——先有可命名、可验证的技能清单,无 AI 评估才有标尺。没有图谱,第二轨永远停留在直觉。
- 在招聘和高潜识别里嵌入双轨,且两分开放。 AI 流利度测一次,独立判断测一次,别合成一个总分糊弄。合并打分只会让稀缺的判断能力继续被埋没。
- 把「无 AI 判断」变成可练的能力,而不只是可测的门槛。 在内部刻意安排脱离 AI 的决策演练,让判断肌肉有真实使用场景,而不是只在面试里被考一次。
判断权是 AI 拿不走的最后资产
WEF《2025 未来就业报告》指出,63% 的雇主把技能缺口列为首要障碍,77% 计划开展再培训。但要分清:再培训主要解决的是第一半(AI 能力),第二半(独立判断)没有现成课程,也无法靠买工具补齐。它只能靠组织有意识地测、练、用,一点点积累。
AI 没有消灭 HR 的评估职能,而是把它从「核对岗位说明书」升级为「守护组织判断权」。这件事,没有工具能替你做,也没有供应商能打包交付。当评估被拆成两半,真正稀缺的那一半——在 AI 之外还能做对判断的人与机制——才是 AI 时代组织最该守住的资产。