招聘筛选中,测量语言、计算、推理、性格等的适性测验(能力倾向测验)用得很普遍。
它能在短时间内比较大量应聘者,对企业来说确实是个方便的工具。基础的阅读理解和数理处理能力,与学东西的快慢、一定程度的工作成果有关,这一点在研究上也没有被否定过。
不过,这里有一个很大的跳跃。
适性测验拿高分,和在真实职场里把事做好,并不是一回事。
真实的工作里,没有现成的题干,也没有选项。必要的信息可能不够,相关的人说法也可能互相矛盾。答案可能不止一个,没人拍板就推进不了。
而且,随着生成式 AI 能高速处理文章理解和固定套路的计算,只考“人在限定时间内独自解题的能力”的考试,与实际工作之间的距离又拉大了。
真正该看的,不只是有没有知识、处理速度快不快。
- 能不能把问题定义清楚
- 信息不足时能不能提出假设
- 能不能排出优先顺序
- 能不能与相关方协调
- 能不能划清责任范围
- 能不能一路做到完成
- 能不能掌握现场特有的知识
- 能不能核实 AI 和工具给出的结果
- 能不能守住他人的自我决定权
工作成果,是由这些能力组合在一起决定的。
而麻烦的是,能力强的人,并不一定就是好的管理者。
第1部分 适性测验测得了什么,又测不了什么
1. 一般认知能力并非“没有意义”
一般认知能力,也就是常说的 GMA,是把阅读理解、推理、数理处理、学习速度等基础能力合起来的一个概念。
研究多次表明,GMA 与工作成果、培训成绩有一定的相关性。尤其是复杂的工作,需要理解新信息并把知识组合起来,所以基础认知能力是有用的。
因此,“适性测验完全没有意义”这个结论同样不对。
如果阅读理解极其困难、处理不了基本的数量关系、短时间内听不懂指示的意思,那么视职位不同,实际工作中可能会遇到困难。如果只是用来确认基础能力的底线,它有一定的合理性。
2. 但它和“会做事”并不画等号
问题在于,把适性测验的分数当成了工作能力本身。
设定课题
也就是自己界定“到底问题是什么”的能力。
考试里,题干是给定的。但在实际工作中,谁在为难、要改善哪种状态、有没有把原因和症状混为一谈、这件事到底值不值得处理,都得自己去判断。
优先顺序
所有事不可能同时处理。
要比较期限、影响范围、法律风险、对客户的影响、工作量、再次发生的可能性等,决定先做什么。
适性测验能测出解答现成题目的能力,却很难测出这个问题现在该不该解决。
在信息不完整时做判断
实际工作中,等信息齐全再动手,往往来不及。
所以必须整理目前已知的事实,把不清楚的部分区分出来,先放一个假设,在可以挽回的范围内行动,有了新信息再修正。
这不是单纯的猜答案,而是做出暂定判断并不断修正的能力。
与相关方协调
就算知道正确答案,相关的人不动,事情也推不下去。
不过这里还有一个重要的区别。
- 向上司或其他部门把事情说通的协调
- 为了让下属好开展工作,理顺信息、权限和分工的协调
有些管理者前者很强,后者却很弱。
坚持与完成
开始和结束是两回事。
提出点子、下达指示、在会上拍板,这些都能做到,但是跟进中途进展、排除障碍、最后验证结果,却做不下去的人很多。
现场知识
光靠一般意义上的聪明,是看不出现场特有的限制的。
设备、合同、法令、交易惯例、系统、过往经过、人员构成等,都得去查清楚,并纳入判断。
核实 AI 的输出
在 AI 时代,比起“自己能不能全部解出来”,更重要的是:输入条件对不对、有没有读错、结论和前提是否一致、有没有漏掉重要的例外、最终判断能不能由人来承担。
重要的不是用不用 AI,而是判断该核实哪些地方才能避免致命失误的能力。
3. 最新研究对“GMA 一枝独秀”的修正
一般认知能力测验长期以来被说成“最强的单一预测因素”。
但近年来有人指出,过去的效度估计可能因为统计校正而被高估了。2024 年更新的元分析(把多项研究合并起来的统计分析)报告称:当把履历信息、结构化面试、责任心、诚信测验、情境判断测验等组合使用时,即使去掉 GMA 测验,整个筛选流程的预测效度也几乎不会下降,这样的组合有很多。
这并不意味着认知能力不重要。
准确地说,是“认知能力是预测工作成果的材料之一,但必须把它放在中心位置的理由,没有以前想的那么强”。
适性测验只是辅助指标,招聘的重心更合理的做法是转向贴近岗位的任务、结构化面试、过往行为的具体事例,以及对工作方式的确认。
4. 生成式 AI 改变了考试的意义
生成式 AI 相当擅长处理排列句子顺序、概括、比例计算、整理条件等,与传统适性测验很接近的题目。
这样一来,在家里无人监督参加的测验,测出来的结果里就混杂了本人的能力、有没有用 AI、输入的图片或文字的质量、给 AI 下指令的方式、核实答案的能力,以及网速和操作速度。
在这种情况下,要把“分数 = 本人的认知能力”来解读,就很困难了。
今后的筛选,不只是严防使用 AI,反而是以使用 AI 为前提,去看对方怎样定义问题、把什么交给了 AI、对输出的哪里产生了怀疑、怎样核实、如何说明最终判断,这样更接近实际工作。
第2部分 能干的“选手”,不一定是好管理者
1. 推理能力和协调能力都很强的管理者
职场里有这样的人:能在信息不完整时迅速提出假设,去现场调查,再向上司或其他部门把事说通。
这类人从外面看非常能干。
- 收集信息快
- 现场知识丰富
- 当场就能判断
- 向上级汇报讲得好
- 与平级部门谈判很强
- 自己一出手就能把项目推进下去
事实上,作为“选手”他们确实很强。
问题在于,这种能力不一定能直接变成管理能力。
2. 管理者的工作不是“自己来解决”
选手只要自己把问题解决,就能做出成绩。
管理者除此之外,还要明确目标、给出判断标准、排定优先顺序、设定负责人和权限、中途提供支持、确认完成,并且让下次本人单独也能复现。
管理者的成绩,不该用本人处理了多少事来衡量,而要看有没有建立起一种状态:即使自己不在,团队也能自行判断并推进。
自己查、自己判断、自己收尾的管理者,乍一看做事很快。但下属那里留不下判断标准,同样的问题一次又一次回到管理者手里。
结果就是:管理者总是很忙,下属无法独立,工作变成只有某个人才懂,管理者一不在就停摆,事后追加的指示越来越多,评价标准只存在于管理者的脑子里。
3. 向上的协调与向下的协调
协调能力也有方向。
向上、向平级的协调
- 说服上司
- 争取其他部门的配合
- 在会议上让自己的主张通过
- 看懂公司内部的政治
- 保住自己的项目
向下的协调
- 把必要的信息交给下属
- 明确谁来决定
- 指明优先顺序
- 建立拒绝的权利和商量的渠道
- 让责任和权限匹配
- 给下属留出自己思考的余地
有些人向上、向平级的协调非常强,向下的协调却很弱。
这样的人在高层眼里是“靠得住的管理者”,在下属眼里却是“不知道标准是什么”“不知道什么时候又会变卦”“不管做什么都会被加活”。
4. 当培养变成“为了自己”
培养也有两种看上去相似、实际不同的形态。
以对方自立为目的的培养,会看对方目前的位置,把判断标准讲清楚,在允许失败的范围内放手,发挥本人的长处,最终的目标是让管理者不必再介入。
而以管理者自身方便为目的的培养,则是让对方学会自己的做法,好让自己不用再解释,让对方抢先迎合自己的期待,不照做就认定是理解不够,最后还是自己来收拾。
后一种从外表看,同样像是热心的培养。
但如果本人手里没有留下判断权,那就不是支持自立,而是把管理者的思维方式灌输进去的训练。
第3部分 善意变成支配的界线
1. 有没有善意,和有没有界线,是两回事
关心别人没有错。给建议、传授经验也是必要的。
问题在于,在哪里停下来。
健康的建议,是这样的形式:“我是这么想的,需要的话可以参考。最终做决定的是你自己。”
越界的建议,则是这样的形式:“我比本人看得更远。他做出别的选择,是因为还没想明白。”
善意越强并不代表越安全。恰恰相反,有了善意,反而更难去怀疑自己的介入。
把刨根问底叫作“真心关怀”,把断言别人的未来叫作“长远眼光”,把不让人拒绝叫作“认真对待”,把对方的抵触解读为“理解不够”。
就这样,本人的自我决定权一点点消失。
2. 为对方着想,和替对方决定人生
管理者或招聘负责人该确认的,是职务所需要的范围。
- 能不能胜任工作内容
- 能不能认可工作条件
- 有没有需要的照顾
- 本人希望怎样工作
- 经验可以怎样发挥
再往后的人生规划,是本人的领域。
日本厚生劳动省(相当于主管劳动和社会保障的政府部门)也要求,公平的招聘筛选中,不要了解与本人的适性、能力无关的私生活信息,并且要事先确定提问项目和评价标准。
重要的不是有没有打算把它当作录用标准。一旦知道了某个信息,就会在无意中掺进对人的评价里。所以需要的不是“先问了再公平对待”,而是一开始就不收集与职务无关的信息这种设计。
3. 推理能力越强,错误的故事也越精密
信息不足时,人会用故事去填补空白。
推理能力强的人,能把很多信息串起来,编出一套前后连贯的说法。但前后连贯,不等于是事实。
本人没说过的未来设想、本人没选过的价值观、替本人假设的生活、自认为“为他好”而定的出路。把这些堆在一起,就会形成一个精密却无法验证的人物形象。
推理能力强的人需要的,不是推理得更多。
- 这是事实吗
- 这是假设吗
- 向本人确认过吗
- 这是不是该由本人决定的领域
- 如果我错了,能不能纠正
需要的是把这几点区分开来。
4. “听人说话”和“把话说死”
成熟的建议者,在说完意见之后,能把判断交还给本人。
“我是这么想的。如果你那样想,我尊重你的选择。”
只要有这一句话,咨询和支配就分开了。
越过界线的人,在对方得出与自己不同的结论时,没办法把话题收住。
觉得还没解释够、对方还没想通、再多说说就会明白,一直要到自己的正确被接受为止。
被说的一方越是有逻辑地解释,就越会被看作“还能继续讨论”,被拖住的时间甚至更长。
这个问题并不是接受方不会表达。问题在于,无法承认对方有做出不同判断的权利。
第4部分 把执行责任还给讲“大道理”的人
1. 大道理不保证可执行
在组织里,光说正确的话并不难。
要全部检查、要杜绝失误、要提高质量、要详细说明、要快速响应、要通知所有人。每一条原则上都没错。
可是,人手、时间、预算、权限都是有限的。
现实中,和“做什么”同样重要的,是决定“不做什么”“推后什么”“谁来负责”。
2. 只抛出理想、把落地推给别人的结构
在不健康的分工里,下达指示的一方说理想、加附加条件、死磕质量、指出不足;而执行的一方要调查现场条件、协调相关方、在期限内做出成果、排好与其他工作的优先顺序,失败了还要负责解释。
在这种结构里,下达指示的一方永远可以站在“正确”的位置上。
因为执行方一说“做不到”,就成了努力不够;硬着头皮去做而失败了,就成了执行失误。
3. 正确的回应方式
需要的不是反驳,而是把条件摆明。
方针我理解了。以目前的人手和期限,无法和现有工作兼顾。如果要求必须实施,请指定需要往后推的工作、负责人、期限和审批人。
另外,如果对方个人的执念特别强,可以这样回应:
如果这个标准和方法是必须的,请由拥有决定权并承担执行责任的人来处理。
这不是撒手不干。只是把判断和责任打包,还给了提出执念的那个人。
4. “世上的事光靠大道理推不动”,对双方都适用
“光靠大道理,组织是动不起来的”,这话没错。
但这句话不只适用于下属。管理者的大道理,同样受现实条件的限制。
如果坚持自己的方案,自己也得承担协调成本和执行责任。
第5部分 为什么看了培训,人还是不变
1. 知识和行为是两回事
看了人权、骚扰、公平招聘、心理安全感等培训,行为仍然不变的人是存在的。
原因之一,是本人并没有把自己归到“问题行为”那一边。
在本人心里,骚扰就是大吼大叫,而自己是在指导;骚扰是怀有恶意的攻击,而自己是为了对方好才这么做。就是这样归类的。
所以,即使听懂了培训内容,也不会用到自己的行为上。
2. 比起培训,日常的奖励机制更强
在组织里,如果越界干涉的人被评价为工作积极、被说成会照顾人、受到高层的信任、没有人能阻止、也不用为结果负责,那么本人就没有改变的必要。
比起看一小时的培训视频,每天的成功体验要强得多。
美国平等就业机会委员会(EEOC,处理职场歧视问题的美国政府机构)的报告也指出,光靠培训不够,还需要一整套机制:高层以身作则、明确的方针、举报制度、调查、纠正措施,以及对管理人员的考核和追责。
培训传递的是知识。改变行为的,是评价、权限、责任和纠正的机制。
3. 人数再少,权力大就会造就文化
越界的人在整个组织里即使是少数,只要职位高、影响力大,危害就不会局限在小范围。
因为他们能插手招聘、评价、人员配置、指导、会议、优先顺序和信息共享。
问题不在人数,而在于在组织里能在多大程度上支配别人的时间和判断。
第6部分 边走边“对墙说话”,同时理顺思路和身体
1. 走路不只是“散心”
想法停不下来的时候,坐在家里一直想,很容易反复纠结同样的点。
而边走边出声思考,脑子里的一团东西会变成语言,变成句子就有了先后顺序;AI 或对方能给出别的看法;景色和身体感觉在变化,情绪的热度降下来;能把事实和解释分开;还能定好下一步,把事情收个尾。
这不只是普通的散步。这是把运动、表达出来、对话、情绪调节和决策合为一体的思考习惯。
(这里说的“对墙说话”,就像打网球时对着墙打球再接回来练习,是把想法说出口,边接收 AI 或对方的回应边整理的做法。)
2. 走路有利于发散思维
2026 年发表的一项关于步行与创造性思维的系统综述和元分析,分析了 23 项研究、共 1,036 人,结果显示步行对发散思维(把点子广泛铺开的思考方式)有很大的改善效果。另一方面,对收敛到唯一正确答案的聚合思维,效果并不明确。
这和实际感受也吻合。
边走边想,找到另一种解释、找出共同结构、回想起例子、换个角度、重新组合措辞,这些都会进展得比较顺。
不过,在最终确定采用与否、合同、金额、期限等的时候,最好走完之后坐下来再确认。
适合在走路时做的事
- 把情绪倒出来
- 拆解论点
- 增加假设
- 寻找共同结构
- 搭文章的骨架
适合在走完之后做的事
- 核对数字
- 核对证据
- 最终判断
- 发送邮件
- 敲定合同或日程
3. “对墙说话”把反复咀嚼变成“处理”
反复琢磨同一件事的反刍式思考,即使想得再多,也不一定在朝结论前进。
在对墙说话的过程中,你把想法说出来,得到回应,再把语言压缩。
那些个别事件原本是以“很缠人”“话太长”“指示总变”“说是为我好”“拒绝了就被说成理解不够”这样的碎片留在脑子里,现在可以归纳成一个解释:侵入他人决定权和执行责任的结构。
解释一旦压缩好了,应对方式也会从“说服对方”变成“把事实、假设、责任、权限和本人的选择分开”。
4. 对身体也是赚的
定期步行对心血管、血糖、睡眠、情绪和体力维持都有好处。
即使体重没有马上下降,把坐着一直想的时间换成走路,活动量也会增加。
尤其是以整理思路为目的的步行习惯,不必另外抽出运动时间,更容易坚持下去。
5. 实践用的简单模板
边走边想的时候,最后按下面五项分一分,更容易收尾。
事实
实际能确认的是什么。
解释
我认为那意味着什么。
假设
还没能确认的猜测是什么。
可控制的
我能改变的是什么。
下一步
今天或下次,要做的一件事是什么。
最后只定一件事。重要的是不要只是把想法越想越多,而是要连到行动上。
第7部分 怎样评价会做事的人
1. 不靠一场考试来定
在招聘和考核中,最好不要依赖单一指标。
贴近实际工作的组合大致是这样:
- 用基础能力测验确认最低限度的阅读理解、数理理解和学习基础
- 用结构化面试,对所有人问同样的核心问题,并事先定好评价标准
- 具体确认过往的行为事例
- 处理贴近真实工作的工作样本(实际任务)
- 在允许使用 AI 的条件下,观察输入、核实、修正和说明
- 观察对方如何理清责任、权限、优先顺序和商量的方式
2. 管理者需要的评价项目
对管理者,不能只看本人的处理能力,还要评价以下几点。
- 有没有营造出下属能自行判断的状态
- 有没有一开始就给出目的和标准
- 有没有让责任和权限匹配
- 有没有不必要地占用下属的时间
- 有没有把不同意见当成“理解不够”来处理
- 给出建议后,有没有把选择交还给本人
- 中途改变条件时有没有作出说明
- 有没有为自己的执念承担执行责任
- 自己不在时工作能不能运转
- 培养之后,本人的自立程度有没有提高
这些,靠短时间的认知能力测验几乎测不出来。
3. 不找完美的人,而是看能否互补
具备所有能力且都很高水平的人,几乎不存在。
问题不在于有弱点。
- 是否了解自己的弱点
- 能不能借用别人的长处
- 能不能靠机制来弥补
- 能不能纠正错误
- 有没有把弱点的代价转嫁给下属
这些才是重点。
结论
适性测验作为确认基础能力的工具,有一定的意义。
但是,会不会做事,光靠它是决定不了的。
在真实的工作中,需要定义问题,在信息不完整时提出假设,排定优先顺序,调动相关方,划分责任与权限,坚持到最后,学习现场,核实 AI,并守住他人的自我决定权。
而且,作为选手能干,并不代表作为管理者也能干。
推理能力、协调能力强的人,如果分不清假设与事实、建议与决定、自己的领域与他人的领域,那么这些能力就会从帮助变成支配。
应对的核心,不是把对方驳倒。
- 把事实和假设分开
- 把建议和决定分开
- 把执念和执行责任绑在一起
- 把该由本人决定的领域还给本人
就是这几点。
而当思路卡住的时候,就边走边把它说出来。
活动身体、把想法说到外面、再压缩成结构,这种习惯能让工作的整理和健康同时变成“盈余”。
