一分钟速读
编者按:有一个数据说出来你可能不信——我们统计过自己经手的中高端岗位,企业自己面试后「不通过」的候选人,其实有将近四分之一是能力完全达标、只是面试时没被正确评估。问题在哪?不是企业面试官不行,是大多数企业的人才评估方法还停留在「聊一下、感觉一下、讨论一下」的阶段。面试本质上是一个测量工具——测量工具没校准,量出来的结果当然不准。这篇文章把猎头行业经过反复验证的三个人才评估原则拆开讲清楚,你可以直接拿去用在下一次面试里。
先问一个问题:你的企业上一次面试失败——选了一个人、入职后发现不合适、三个月后离职——问题出在哪里?
大部分企业的复盘结论是「这个人不行」「面试的时候没看出来」。但这个结论本身就有问题——如果面试的设计目的是「看出来一个人行不行」,而你没看出来,说明问题可能不在人、在面试本身的设计。
猎头行业每天在做的事情就是人才评估。我们有三个基础认知,而这恰恰是大多数企业内部招聘没有做到的。其一,人才评估不是「感觉」而是「测量」——需要明确的维度和量化的标准。其二,面试本质上是行为采样——你通过候选人描述他在特定场景下的真实行为来推断他未来在类似场景下的表现。其三,单次面试的信度很低——再好的面试官也有自己的偏好和盲区,必须通过多维度交叉验证来抵消单点判断的偏差。
说得直白一点:如果你面试只靠「聊聊看」,选对人的概率不会比扔硬币高多少。这不是危言耸听——组织心理学几十年的研究反复验证了这一点。真正能提升面试准确率的,不是面试官更有经验,而是面试方法更结构化。百猎猎头在为企业推荐中高端候选人时,首先交付的不是一份简历,而是一份包含STAR行为评估的多维人才评估报告——因为我们知道,没有评估报告的人才推荐就是让客户自己去碰运气。
这是最常见也最危险的一个误区。面试完几个候选人,面试官坐在一起讨论:「A沟通能力强,感觉挺有想法的」「B履历很好,大厂出来的不会太差」「C虽然没有很亮眼,但我个人挺喜欢他的」。讨论完选了一个「感觉最好的」,入职后发现不对,再来一轮。
这个流程的问题不是面试官不专业——问题在于「凭感觉」这个行为本身。感觉是主观的、不稳定的、高度依赖个体偏好的。同一个候选人在上午十点和下午四点被同一个人面试,结果都可能不同。更不要说不同面试官对同一个人的评价——差距经常大到像是面了两个不同的人。
猎头行业的解决方案是结构化评分维度。做法很简单:面试之前,先把岗位需要的核心能力拆成5到7个具体维度——比如「商业分析能力」「跨部门沟通能力」「项目推动力」「抗压适应性」「团队领导力」。每个维度定义清楚什么是1分什么是5分——不是抽象的「好」和「差」,而是具体可观察的行为描述。面试后每个维度独立打分,总分汇总。不同面试官对同一候选人的评分差异立刻可见——差异大于2分的维度要拿出来专门讨论。这个过程把一个「看感觉」的决策变成了一个「看数据」的决策。
举个例子:一个产品总监岗位,拆成「产品战略思维」「数据驱动决策」「跨部门推动」「用户洞察」「团队搭建」五个维度。每个面试官面完后分别打分,合在一起看雷达图。如果「用户洞察」所有人都给了4分以上但「跨部门推动」出现了1分和4分的巨大分歧——那就在终面环节专门深挖这件事,而不是笼统地讨论「这个人怎么样」。武汉猎头公司在服务光谷企业时,经常帮客户建立这种结构化评估体系——因为科技型企业对人才判断的精度要求更高,凭感觉的代价太大。
一个典型的场景:面试官问「介绍一下你做得最成功的项目」,候选人讲了五分钟,面试官频频点头、偶尔追问一些细节,气氛很好,面试结束时双方都觉得「这次聊得不错」。然后候选人拿到了offer,入职后发现他根本不会干他说的那个项目里的事——他只是很会讲。
为什么会这样?因为「聊」和「问」是两回事。聊天是顺着对方的话往下走,对方说什么你听什么;追问是沿着一个行为链条往深处刨,直到你能在脑子里把那个场景完全还原出来。候选人在面试中讲的任何一件事,如果没有被追问到「具体怎么做的」「做什么步骤」「当时遇到了什么困难怎么解决的」「结果能不能用数字描述」这个级别——他讲的就只是一段精心准备的话术,不是一段真实的行为证据。
猎头行业用STAR追问法来解这个问题。STAR是Situation(当时什么情况)、Task(你要做什么)、Action(你具体做了什么动作)、Result(产生了什么结果)的缩写。面试官沿着这四个环节逐层追问——「当时为什么是你来做而不是别人」「你做的时候第一步干什么第二步干什么」「中间有没有人反对你怎么说服他们的」「最后的结果你有具体数字吗比如提升了多少降本了多少」。追到候选人能说出具体的日期、人名、数字、遇到的具体阻力、当时的心理活动——这才是真实经历。讲不出来的人会被追到空白地带。
一个实际例子:候选人说自己主导过一次跨部门流程优化。用STAR追问——S:「当时是什么触发了这个优化需求,具体谁提出来的?」T:「你在这个项目里的具体角色是什么,是发起人还是执行人?」A:「你做的第一个动作是什么,你联系的第一个人是谁,他说了什么你回了他什么?」R:「优化后的流程比原来效率提升了多少,你有具体数据吗?」追问到第五层,能完整回答的人不超过三分之一。那三分之二就是面试时聊得挺好、入职后发现不对的人。百猎的人才寻访服务中,STAR评估是交付给客户的人才报告的核心组成部分。
假问题是指那些不基于候选人真实经历、让候选人想象一个虚拟场景来回答的问题。比如「如果你团队里有一个人能力不行又不服管你怎么办」「如果客户临时推翻方案要求你三天重做你会怎么应对」「如果公司给你一个不可能完成的目标你怎么拆」。
这些问题有什么毛病?它们测试的不是候选人的真实行为模式,而是候选人的语言组织能力和表演水平。任何一个准备过面试的候选人——尤其是中高端人才——对这些问题都能给出漂亮的理论性回答。因为假问题不需要事实支撑,答案对错无可验证。更有意思的是,人在回答假问题时,会用「理想自我」的状态来回答而非「真实自我」。他告诉你的不是他曾经怎么做,而是他认为应该怎么做——而这两个东西之间的差距,就是入职三个月后你会看到的落差。
正确的问法是把假问题改成真问题——加一个前缀:「请讲一个你亲身经历过的事——」。「你团队里有没有真的出现过能力不行又不服管的人?你怎么处理的?结果怎么样?」「你在过去的工作中有没有遇到过客户临时推翻方案让你三天重做?能不能讲一下那次你是怎么扛过来的?」真的经历过的人在回答时会有丰富的细节——具体的时间、当时的情绪、做出的艰难选择、事后的反思。没经历过的人在回答假想题时也能说得头头是道,但在回答真实经历题时就会出现大段空白。这个差别就是区分真假高手的试金石。成都猎头公司服务的数字文创企业中,很多创始人非常擅长用这种真实经历提问法筛选出真正有自驱力的人才——因为在创意行业,能说的比能做的多太多了。
把以上三个误区的解决方案整合在一起,就是猎头行业经过验证的三件核心评估工具。
工具一:结构化评分维度表。准备任何一次面试前,先把岗位拆成5到7个能力维度,每个维度写好1分到5分的行为描述。举个例子——「跨部门推动力」这个维度,1分的行为描述是「遇到跨部门阻力时等待领导协调」,5分的行为描述是「主动识别利益相关方、设计共赢方案、在没有正式职权的情况下推动多部门达成一致」。面试时根据候选人的回答对照打分。整个面试过程的最终产出不是一句「这个人不错」的评价,而是一个有结构、有行为锚点的多维评分表。
工具二:STAR行为追问法。面试过程至少70%的时间花在追问具体行为上。每个关键能力问一个过往的真实案例,用STAR框架逐层深挖。追问的三个铁律:追到他说出具体的人名和数字、追到他说出当时面临的真实阻力和自己做出的选择(不是事后诸葛亮式的正确回答)、追到他说出结果是否可量化以及他本人贡献的占比(不是团队整体的成绩)。
工具三:多维评估矩阵。一个候选人至少由两个人分别面试、分别独立打分,然后做交叉比对。如果两个人的评分在一个维度上差了两分以上——这个候选人在这个维度上大概率有问题,需要在终面中专门深挖。如果多轮的多个维度的评分都是趋同的,那就可以高置信度地判断候选人在这些维度上的真实水平。这个矩阵不仅提升了判断的准确性,也为后续的录用决策提供了可解释、可回溯的依据。
三件工具叠加使用的效果不是加法而是乘法。单独用结构化评分能提升30%的准确率,单独用STAR追问能提升25%,单独用多轮交叉验证能提升20%。三者叠加——优秀猎头的面试准确率可以做到80%以上。这也是为什么企业愿意为猎头付费的底层逻辑——百猎猎头卖的不是简历,是用这套评估体系帮你把选对人的成功率从扔硬币提高到80%。合肥芯片人才的薪资拆解中有更多行业人才深度分析的案例。
一家企业不能只靠某个特别会面试的创始人或者HR——人走了体系就塌了。要建立一个不依赖个人的、可复制的人才评估体系,三步就够了。
第一步:建立岗位能力模型。不要把这个东西想得太复杂。不做咨询公司那种一百页的能力词典——做一页纸的。每个关键岗位列出5到7项核心能力,每项能力用一句话描述好和差的分别是什么。用具体的、可观察的行为语言来描述,不要用抽象词。比如不要说「沟通能力强」——说「能把复杂的技术问题用业务方听得懂的语言讲清楚、并且业务方能复述出关键要点」。
第二步:统一面试流程。所有面试官共用一套标准的面试模板——第一轮聚焦硬技能和过往项目经验、第二轮聚焦软技能和团队协作、第三轮(如有)聚焦价值观和文化匹配。每一轮都有对应的STAR问题库和评分表。面试官可以自由追问,但核心维度和基础问题框架是统一的。面试后必须在24小时内完成评分,避免记忆衰退带来的偏差。
第三步:定期校准面试官。每季度做一次面试官校准会——拿出几个候选人的面试录像或记录,所有面试官各自打分,然后对比评分差异。差异超过2分的维度拿出来讨论——「你为什么给了4分,你觉得他哪个行为表现出了这个水平」。这种校准不是培训,是让所有面试官对「好」的标准形成共识。一家做过三次季度校准的企业,面试准确率可以从50%提到75%——这个提升幅度超过任何单项改进。福州IT服务人才招聘的案例中也有关于企业招聘体系建设的详细讨论。
扫码添加企业微信