适性测验高分,就等于会做事吗?招聘、管理者与边走边想

阅读功能说明

收听会朗读正文;速读会按顺序显示短语,速度可调。语言练习可对照已有的不同语言版本。收藏保存在本浏览器中,可从播放器的收藏列表再次打开。

分享这篇文章

分享这篇文章

广告
广告

招聘筛选中,测量语言、计算、推理、性格等的适性测验(能力倾向测验)用得很普遍。

它能在短时间内比较大量应聘者,对企业来说确实是个方便的工具。基础的阅读理解和数理处理能力,与学东西的快慢、一定程度的工作成果有关,这一点在研究上也没有被否定过。

不过,这里有一个很大的跳跃。

适性测验拿高分,和在真实职场里把事做好,并不是一回事。

真实的工作里,没有现成的题干,也没有选项。必要的信息可能不够,相关的人说法也可能互相矛盾。答案可能不止一个,没人拍板就推进不了。

而且,随着生成式 AI 能高速处理文章理解和固定套路的计算,只考“人在限定时间内独自解题的能力”的考试,与实际工作之间的距离又拉大了。

真正该看的,不只是有没有知识、处理速度快不快。

  • 能不能把问题定义清楚
  • 信息不足时能不能提出假设
  • 能不能排出优先顺序
  • 能不能与相关方协调
  • 能不能划清责任范围
  • 能不能一路做到完成
  • 能不能掌握现场特有的知识
  • 能不能核实 AI 和工具给出的结果
  • 能不能守住他人的自我决定权

工作成果,是由这些能力组合在一起决定的。

而麻烦的是,能力强的人,并不一定就是好的管理者。

第1部分 适性测验测得了什么,又测不了什么

1. 一般认知能力并非“没有意义”

一般认知能力,也就是常说的 GMA,是把阅读理解、推理、数理处理、学习速度等基础能力合起来的一个概念。

研究多次表明,GMA 与工作成果、培训成绩有一定的相关性。尤其是复杂的工作,需要理解新信息并把知识组合起来,所以基础认知能力是有用的。

因此,“适性测验完全没有意义”这个结论同样不对。

如果阅读理解极其困难、处理不了基本的数量关系、短时间内听不懂指示的意思,那么视职位不同,实际工作中可能会遇到困难。如果只是用来确认基础能力的底线,它有一定的合理性。

2. 但它和“会做事”并不画等号

问题在于,把适性测验的分数当成了工作能力本身。

设定课题

也就是自己界定“到底问题是什么”的能力。

考试里,题干是给定的。但在实际工作中,谁在为难、要改善哪种状态、有没有把原因和症状混为一谈、这件事到底值不值得处理,都得自己去判断。

优先顺序

所有事不可能同时处理。

要比较期限、影响范围、法律风险、对客户的影响、工作量、再次发生的可能性等,决定先做什么。

适性测验能测出解答现成题目的能力,却很难测出这个问题现在该不该解决。

在信息不完整时做判断

实际工作中,等信息齐全再动手,往往来不及。

所以必须整理目前已知的事实,把不清楚的部分区分出来,先放一个假设,在可以挽回的范围内行动,有了新信息再修正。

这不是单纯的猜答案,而是做出暂定判断并不断修正的能力。

与相关方协调

就算知道正确答案,相关的人不动,事情也推不下去。

不过这里还有一个重要的区别。

  • 向上司或其他部门把事情说通的协调
  • 为了让下属好开展工作,理顺信息、权限和分工的协调

有些管理者前者很强,后者却很弱。

坚持与完成

开始和结束是两回事。

提出点子、下达指示、在会上拍板,这些都能做到,但是跟进中途进展、排除障碍、最后验证结果,却做不下去的人很多。

现场知识

光靠一般意义上的聪明,是看不出现场特有的限制的。

设备、合同、法令、交易惯例、系统、过往经过、人员构成等,都得去查清楚,并纳入判断。

核实 AI 的输出

在 AI 时代,比起“自己能不能全部解出来”,更重要的是:输入条件对不对、有没有读错、结论和前提是否一致、有没有漏掉重要的例外、最终判断能不能由人来承担。

重要的不是用不用 AI,而是判断该核实哪些地方才能避免致命失误的能力。

3. 最新研究对“GMA 一枝独秀”的修正

一般认知能力测验长期以来被说成“最强的单一预测因素”。

但近年来有人指出,过去的效度估计可能因为统计校正而被高估了。2024 年更新的元分析(把多项研究合并起来的统计分析)报告称:当把履历信息、结构化面试、责任心、诚信测验、情境判断测验等组合使用时,即使去掉 GMA 测验,整个筛选流程的预测效度也几乎不会下降,这样的组合有很多。

这并不意味着认知能力不重要。

准确地说,是“认知能力是预测工作成果的材料之一,但必须把它放在中心位置的理由,没有以前想的那么强”。

适性测验只是辅助指标,招聘的重心更合理的做法是转向贴近岗位的任务、结构化面试、过往行为的具体事例,以及对工作方式的确认。

4. 生成式 AI 改变了考试的意义

生成式 AI 相当擅长处理排列句子顺序、概括、比例计算、整理条件等,与传统适性测验很接近的题目。

这样一来,在家里无人监督参加的测验,测出来的结果里就混杂了本人的能力、有没有用 AI、输入的图片或文字的质量、给 AI 下指令的方式、核实答案的能力,以及网速和操作速度。

在这种情况下,要把“分数 = 本人的认知能力”来解读,就很困难了。

今后的筛选,不只是严防使用 AI,反而是以使用 AI 为前提,去看对方怎样定义问题、把什么交给了 AI、对输出的哪里产生了怀疑、怎样核实、如何说明最终判断,这样更接近实际工作。

第2部分 能干的“选手”,不一定是好管理者

1. 推理能力和协调能力都很强的管理者

职场里有这样的人:能在信息不完整时迅速提出假设,去现场调查,再向上司或其他部门把事说通。

这类人从外面看非常能干。

  • 收集信息快
  • 现场知识丰富
  • 当场就能判断
  • 向上级汇报讲得好
  • 与平级部门谈判很强
  • 自己一出手就能把项目推进下去

事实上,作为“选手”他们确实很强。

问题在于,这种能力不一定能直接变成管理能力。

2. 管理者的工作不是“自己来解决”

选手只要自己把问题解决,就能做出成绩。

管理者除此之外,还要明确目标、给出判断标准、排定优先顺序、设定负责人和权限、中途提供支持、确认完成,并且让下次本人单独也能复现。

管理者的成绩,不该用本人处理了多少事来衡量,而要看有没有建立起一种状态:即使自己不在,团队也能自行判断并推进。

自己查、自己判断、自己收尾的管理者,乍一看做事很快。但下属那里留不下判断标准,同样的问题一次又一次回到管理者手里。

结果就是:管理者总是很忙,下属无法独立,工作变成只有某个人才懂,管理者一不在就停摆,事后追加的指示越来越多,评价标准只存在于管理者的脑子里。

3. 向上的协调与向下的协调

协调能力也有方向。

向上、向平级的协调

  • 说服上司
  • 争取其他部门的配合
  • 在会议上让自己的主张通过
  • 看懂公司内部的政治
  • 保住自己的项目

向下的协调

  • 把必要的信息交给下属
  • 明确谁来决定
  • 指明优先顺序
  • 建立拒绝的权利和商量的渠道
  • 让责任和权限匹配
  • 给下属留出自己思考的余地

有些人向上、向平级的协调非常强,向下的协调却很弱。

这样的人在高层眼里是“靠得住的管理者”,在下属眼里却是“不知道标准是什么”“不知道什么时候又会变卦”“不管做什么都会被加活”。

4. 当培养变成“为了自己”

培养也有两种看上去相似、实际不同的形态。

以对方自立为目的的培养,会看对方目前的位置,把判断标准讲清楚,在允许失败的范围内放手,发挥本人的长处,最终的目标是让管理者不必再介入。

而以管理者自身方便为目的的培养,则是让对方学会自己的做法,好让自己不用再解释,让对方抢先迎合自己的期待,不照做就认定是理解不够,最后还是自己来收拾。

后一种从外表看,同样像是热心的培养。

但如果本人手里没有留下判断权,那就不是支持自立,而是把管理者的思维方式灌输进去的训练。

第3部分 善意变成支配的界线

1. 有没有善意,和有没有界线,是两回事

关心别人没有错。给建议、传授经验也是必要的。

问题在于,在哪里停下来。

健康的建议,是这样的形式:“我是这么想的,需要的话可以参考。最终做决定的是你自己。”

越界的建议,则是这样的形式:“我比本人看得更远。他做出别的选择,是因为还没想明白。”

善意越强并不代表越安全。恰恰相反,有了善意,反而更难去怀疑自己的介入。

把刨根问底叫作“真心关怀”,把断言别人的未来叫作“长远眼光”,把不让人拒绝叫作“认真对待”,把对方的抵触解读为“理解不够”。

就这样,本人的自我决定权一点点消失。

2. 为对方着想,和替对方决定人生

管理者或招聘负责人该确认的,是职务所需要的范围。

  • 能不能胜任工作内容
  • 能不能认可工作条件
  • 有没有需要的照顾
  • 本人希望怎样工作
  • 经验可以怎样发挥

再往后的人生规划,是本人的领域。

日本厚生劳动省(相当于主管劳动和社会保障的政府部门)也要求,公平的招聘筛选中,不要了解与本人的适性、能力无关的私生活信息,并且要事先确定提问项目和评价标准。

重要的不是有没有打算把它当作录用标准。一旦知道了某个信息,就会在无意中掺进对人的评价里。所以需要的不是“先问了再公平对待”,而是一开始就不收集与职务无关的信息这种设计。

3. 推理能力越强,错误的故事也越精密

信息不足时,人会用故事去填补空白。

推理能力强的人,能把很多信息串起来,编出一套前后连贯的说法。但前后连贯,不等于是事实。

本人没说过的未来设想、本人没选过的价值观、替本人假设的生活、自认为“为他好”而定的出路。把这些堆在一起,就会形成一个精密却无法验证的人物形象。

推理能力强的人需要的,不是推理得更多。

  • 这是事实吗
  • 这是假设吗
  • 向本人确认过吗
  • 这是不是该由本人决定的领域
  • 如果我错了,能不能纠正

需要的是把这几点区分开来。

4. “听人说话”和“把话说死”

成熟的建议者,在说完意见之后,能把判断交还给本人。

“我是这么想的。如果你那样想,我尊重你的选择。”

只要有这一句话,咨询和支配就分开了。

越过界线的人,在对方得出与自己不同的结论时,没办法把话题收住。

觉得还没解释够、对方还没想通、再多说说就会明白,一直要到自己的正确被接受为止。

被说的一方越是有逻辑地解释,就越会被看作“还能继续讨论”,被拖住的时间甚至更长。

这个问题并不是接受方不会表达。问题在于,无法承认对方有做出不同判断的权利。

第4部分 把执行责任还给讲“大道理”的人

1. 大道理不保证可执行

在组织里,光说正确的话并不难。

要全部检查、要杜绝失误、要提高质量、要详细说明、要快速响应、要通知所有人。每一条原则上都没错。

可是,人手、时间、预算、权限都是有限的。

现实中,和“做什么”同样重要的,是决定“不做什么”“推后什么”“谁来负责”。

2. 只抛出理想、把落地推给别人的结构

在不健康的分工里,下达指示的一方说理想、加附加条件、死磕质量、指出不足;而执行的一方要调查现场条件、协调相关方、在期限内做出成果、排好与其他工作的优先顺序,失败了还要负责解释。

在这种结构里,下达指示的一方永远可以站在“正确”的位置上。

因为执行方一说“做不到”,就成了努力不够;硬着头皮去做而失败了,就成了执行失误。

3. 正确的回应方式

需要的不是反驳,而是把条件摆明。

方针我理解了。以目前的人手和期限,无法和现有工作兼顾。如果要求必须实施,请指定需要往后推的工作、负责人、期限和审批人。

另外,如果对方个人的执念特别强,可以这样回应:

如果这个标准和方法是必须的,请由拥有决定权并承担执行责任的人来处理。

这不是撒手不干。只是把判断和责任打包,还给了提出执念的那个人。

4. “世上的事光靠大道理推不动”,对双方都适用

“光靠大道理,组织是动不起来的”,这话没错。

但这句话不只适用于下属。管理者的大道理,同样受现实条件的限制。

如果坚持自己的方案,自己也得承担协调成本和执行责任。

第5部分 为什么看了培训,人还是不变

1. 知识和行为是两回事

看了人权、骚扰、公平招聘、心理安全感等培训,行为仍然不变的人是存在的。

原因之一,是本人并没有把自己归到“问题行为”那一边。

在本人心里,骚扰就是大吼大叫,而自己是在指导;骚扰是怀有恶意的攻击,而自己是为了对方好才这么做。就是这样归类的。

所以,即使听懂了培训内容,也不会用到自己的行为上。

2. 比起培训,日常的奖励机制更强

在组织里,如果越界干涉的人被评价为工作积极、被说成会照顾人、受到高层的信任、没有人能阻止、也不用为结果负责,那么本人就没有改变的必要。

比起看一小时的培训视频,每天的成功体验要强得多。

美国平等就业机会委员会(EEOC,处理职场歧视问题的美国政府机构)的报告也指出,光靠培训不够,还需要一整套机制:高层以身作则、明确的方针、举报制度、调查、纠正措施,以及对管理人员的考核和追责。

培训传递的是知识。改变行为的,是评价、权限、责任和纠正的机制。

3. 人数再少,权力大就会造就文化

越界的人在整个组织里即使是少数,只要职位高、影响力大,危害就不会局限在小范围。

因为他们能插手招聘、评价、人员配置、指导、会议、优先顺序和信息共享。

问题不在人数,而在于在组织里能在多大程度上支配别人的时间和判断。

第6部分 边走边“对墙说话”,同时理顺思路和身体

1. 走路不只是“散心”

想法停不下来的时候,坐在家里一直想,很容易反复纠结同样的点。

而边走边出声思考,脑子里的一团东西会变成语言,变成句子就有了先后顺序;AI 或对方能给出别的看法;景色和身体感觉在变化,情绪的热度降下来;能把事实和解释分开;还能定好下一步,把事情收个尾。

这不只是普通的散步。这是把运动、表达出来、对话、情绪调节和决策合为一体的思考习惯。

(这里说的“对墙说话”,就像打网球时对着墙打球再接回来练习,是把想法说出口,边接收 AI 或对方的回应边整理的做法。)

2. 走路有利于发散思维

2026 年发表的一项关于步行与创造性思维的系统综述和元分析,分析了 23 项研究、共 1,036 人,结果显示步行对发散思维(把点子广泛铺开的思考方式)有很大的改善效果。另一方面,对收敛到唯一正确答案的聚合思维,效果并不明确。

这和实际感受也吻合。

边走边想,找到另一种解释、找出共同结构、回想起例子、换个角度、重新组合措辞,这些都会进展得比较顺。

不过,在最终确定采用与否、合同、金额、期限等的时候,最好走完之后坐下来再确认。

适合在走路时做的事

  • 把情绪倒出来
  • 拆解论点
  • 增加假设
  • 寻找共同结构
  • 搭文章的骨架

适合在走完之后做的事

  • 核对数字
  • 核对证据
  • 最终判断
  • 发送邮件
  • 敲定合同或日程

3. “对墙说话”把反复咀嚼变成“处理”

反复琢磨同一件事的反刍式思考,即使想得再多,也不一定在朝结论前进。

在对墙说话的过程中,你把想法说出来,得到回应,再把语言压缩。

那些个别事件原本是以“很缠人”“话太长”“指示总变”“说是为我好”“拒绝了就被说成理解不够”这样的碎片留在脑子里,现在可以归纳成一个解释:侵入他人决定权和执行责任的结构。

解释一旦压缩好了,应对方式也会从“说服对方”变成“把事实、假设、责任、权限和本人的选择分开”。

4. 对身体也是赚的

定期步行对心血管、血糖、睡眠、情绪和体力维持都有好处。

即使体重没有马上下降,把坐着一直想的时间换成走路,活动量也会增加。

尤其是以整理思路为目的的步行习惯,不必另外抽出运动时间,更容易坚持下去。

5. 实践用的简单模板

边走边想的时候,最后按下面五项分一分,更容易收尾。

事实

实际能确认的是什么。

解释

我认为那意味着什么。

假设

还没能确认的猜测是什么。

可控制的

我能改变的是什么。

下一步

今天或下次,要做的一件事是什么。

最后只定一件事。重要的是不要只是把想法越想越多,而是要连到行动上。

第7部分 怎样评价会做事的人

1. 不靠一场考试来定

在招聘和考核中,最好不要依赖单一指标。

贴近实际工作的组合大致是这样:

  • 用基础能力测验确认最低限度的阅读理解、数理理解和学习基础
  • 用结构化面试,对所有人问同样的核心问题,并事先定好评价标准
  • 具体确认过往的行为事例
  • 处理贴近真实工作的工作样本(实际任务)
  • 在允许使用 AI 的条件下,观察输入、核实、修正和说明
  • 观察对方如何理清责任、权限、优先顺序和商量的方式

2. 管理者需要的评价项目

对管理者,不能只看本人的处理能力,还要评价以下几点。

  • 有没有营造出下属能自行判断的状态
  • 有没有一开始就给出目的和标准
  • 有没有让责任和权限匹配
  • 有没有不必要地占用下属的时间
  • 有没有把不同意见当成“理解不够”来处理
  • 给出建议后,有没有把选择交还给本人
  • 中途改变条件时有没有作出说明
  • 有没有为自己的执念承担执行责任
  • 自己不在时工作能不能运转
  • 培养之后,本人的自立程度有没有提高

这些,靠短时间的认知能力测验几乎测不出来。

3. 不找完美的人,而是看能否互补

具备所有能力且都很高水平的人,几乎不存在。

问题不在于有弱点。

  • 是否了解自己的弱点
  • 能不能借用别人的长处
  • 能不能靠机制来弥补
  • 能不能纠正错误
  • 有没有把弱点的代价转嫁给下属

这些才是重点。

结论

适性测验作为确认基础能力的工具,有一定的意义。

但是,会不会做事,光靠它是决定不了的。

在真实的工作中,需要定义问题,在信息不完整时提出假设,排定优先顺序,调动相关方,划分责任与权限,坚持到最后,学习现场,核实 AI,并守住他人的自我决定权。

而且,作为选手能干,并不代表作为管理者也能干。

推理能力、协调能力强的人,如果分不清假设与事实、建议与决定、自己的领域与他人的领域,那么这些能力就会从帮助变成支配。

应对的核心,不是把对方驳倒。

  • 把事实和假设分开
  • 把建议和决定分开
  • 把执念和执行责任绑在一起
  • 把该由本人决定的领域还给本人

就是这几点。

而当思路卡住的时候,就边走边把它说出来。

活动身体、把想法说到外面、再压缩成结构,这种习惯能让工作的整理和健康同时变成“盈余”。


分享这篇文章

广告

今天读这篇

每一篇都回答读完本文后常有的下一个问题。

浏览全部文章更多「工作」文章

查找其他文章

所有文章

Mendoi-chan

本站运营者

Mendoi-chan

把工作与日常生活中的麻烦整理成清晰的结构和下一步行动。

广告

最新文章

  1. 1AdSense 审核总是不通过,至少告诉我到底哪里有问题
  2. 2读者看不到文末,就别把正文夹成广告三明治:把电脑端“空着的两侧”卖出去的 Adsterra 布局
  3. 3AI时代的聪明,是会设计问题而非给出答案
  4. 4一周时间,AI写文章的流程变成了“自主工厂”
  5. 5精神心理门诊要求必须戴口罩,不买就拒诊,这样行吗?
广告