2023年,我经手的一家千人规模科技公司,人才盘点九宫格出结果后,CEO看着表格问了一句:“为什么我们A级员工两年没换过,但业绩增长反而停滞了?”会议室鸦雀无声。HRD解释说,这几位A级员工都是技术骨干,绩效连续两年S级,潜力评价也高。但问题在于,这个九宫格里的“优秀人才”没有一个被实际调动过,他们被长时间锁死在同一个岗位上,潜能评估完全依赖直属上级的一张表,没有经过任何横向校准。那次盘点,九宫格上看起来漂亮,实际上成了晋升通道的“安慰剂”。人才盘点的九宫格,如果只有“填格子”的动作,没有“校准”的机制,本质上就是一张带着主观偏见的成绩单。 我做了五年的人力资源数字化咨询,见过太多企业在九宫格这个环节翻车。今天,我想把我在这件事上踩过的坑、验证过的数据、以及一套能落地的运营工具逻辑,完完整整地拆给你看。
如果你问一个HR,人才盘点的核心是什么,多数人会回答“九宫格”。但九宫格只是一个静态的快照,而人才盘点真正要解决的是“如何把对的人放到对的位置上,并持续驱动他们成长”。校准,是人才盘点从“填表游戏”变成“战略决策引擎”的唯一转换器。 没有经过校准的九宫格,它的准确率在我的样本数据里,只有不到45%。而经过一套标准化的运营工具进行校准后,准确率可以提升到82%以上。
我的核心结论有三点:

我和一家中型制造企业的HRD聊过,他们公司每年花三个月做人才盘点,九宫格做完,大家草草看一下,然后归档。第二年,发现去年被放在“明星”格子里的人,要么离职了,要么绩效下滑了。而放在“金牛”格子里的人,却一直没被重用,导致人才断层。这样的事情,在绝大多数企业里反复上演。
很多企业的九宫格,横轴是绩效,纵轴是潜力。但问题是,绩效数据本身可能就不干净。比如,一个销售因为恰好分到了华南大区,市场行情好,业绩远超其他区域,他的绩效得分天然就高。但你能说他的能力比华东的销售强吗?不能。同样,潜力评估更是“重灾区”。大多数公司用的潜力评估,就是管理者根据“感觉”打分。“这个人看起来很努力”、“这个人平时话不多但很稳”,这些主观判断,让潜力这个维度几乎失去参考价值。
在多头汇报的矩阵式组织里,校准失灵的情况最严重。我见过一个案例,研发总监为了保护自己团队的核心成员,给所有技术骨干都打了“高潜力”。而市场总监则因为部门绩效压力大,为了安抚团队,普遍打了“中潜力”。当两者放在一起校准的时候,两边都觉得对方不公正。如果没有一个客观的运营工具来拉平这个“宽严尺度”,校准会直接变成一场互相攻击的闹剧。
这是我见过最普遍的问题。很多企业把九宫格定位作为晋升、调薪的唯一依据,结果导致员工一旦被放进某个格子,就再也没有机会出来了。九宫格应该是动态的,是人才流动的导航图,而不是贴在员工身上的永久标签。 我见过一个工程师,因为一次项目延期,被放进了“问题员工”的格子,之后两年无论怎么努力,晋升名单里都没有他,最后只好离职。而他的离职,直接导致公司一个核心产品线停摆三个月。

我这些年看过几百份人才盘点报告,发现企业在校准上犯的错,出奇的一致。下面我拆解三个最常见的误区,每一个都是我亲身经历过,并且付过学费的。
这是最典型的错误。很多HR部门把校准理解为“强制分布”。比如,必须有多少比例的人进“明星”格,多少比例进“问题员工”格。为了达到这个比例,HR会和各部门管理者进行“讨价还价”?“你部门A级员工太多了,必须砍掉两个。”“你部门C级员工不够,再补一个。”这种校准,本质上是在做“数字游戏”,而不是在“识别人才”。 结果就是,一些真正优秀但因为部门人数原因被强行降格的人,会立刻感到不公平,从而产生离职倾向。而一些被“凑数”放进高格子里的人,也会因为德不配位而陷入尴尬。
另一种常见情况是,CEO或VP一个人说了算。本来应该是高层、HR、业务负责人三方共同校准的会议,变成了最高领导一个人的“一言堂”。领导说“我觉得小王不错”,大家就都顺着说。领导说“小李最近业绩不好,放低潜力吧”,就没人敢反驳。这种校准,完全依赖一个人的判断偏差,风险极高。 我见过一位CEO,因为特别喜欢某个员工“会来事”,硬生生把一个业绩平平、潜力一般的人拉进了“高潜人才池”,结果后续几年,这个人在高潜班表现极差,不仅浪费了公司的培训资源,还带了坏风气。
很多企业把人才盘点当成一个“年度项目”,九宫格一年更新一次,校准会一年开一次。但人才的流动、绩效的变化、潜力的激发,是动态的。一个员工可能上半年因为家庭原因业绩下滑,下半年恢复状态,但你要等到年底才能把他从“问题员工”格子里挪出来吗?校准的频率,应该和人才流动的速度相匹配。 对于互联网、科技等快速变化的行业,月度甚至两周一次的“轻校准”都很有必要。而对于传统制造业,季度校准可能就足够了。但无论如何,一年一次都太慢了。

既然明白了误区,我们来聊聊怎么做。我认为,一套好的九宫格校准运营工具,必须满足三个核心逻辑:数据化、动态化、透明化。
潜力评估是最难量化的。我不建议管理者直接打分,而是让他们基于“行为锚定”来提供证据。比如,不用问“你觉得小张的潜力是A、B还是C?”,而是问“在过去半年里,小张有没有做过以下行为:独立主导了一个跨部门项目、主动学习了一门新技能并应用到工作中、在团队内部实现了知识分享和沉淀?” 把这些行为点记录下来,形成“行为证据库”。运营工具应该能自动抓取这些行为数据,比如项目管理系统里的任务记录、学习平台上的课程完成率、内部知识库的贡献量、甚至是他迭代了多少份文档。 当这些客观数据堆叠起来,管理者的主观判断就有了锚点。
我理想中的九宫格,不是一张静态的Excel表,而是一个实时更新的“人才仪表盘”。运营工具应该能做到“事件驱动”的校准。 比如,员工完成了一个里程碑式的项目,系统自动触发一次“人才评估”提醒;员工绩效连续三个月下滑,系统自动将其标记为“关注对象”,并推送给直属上级。这样,校准不再是年末的一次性动作,而是贯穿全年的持续管理行为。我见过一家公司,他们的工具可以设定“校准触发阀值”,比如当员工的绩效得分连续两个月超过部门平均分15%以上,系统会自动将其从“稳健”格子移入“潜力”格子,并通知HRBP进行复核。这种动态调整,让人才盘点的时效性提升了数倍。
这是消除“本位主义”和“一言堂”的关键。运营工具必须提供一个“校准驾驶舱”,让所有参与校准的人都能看到每一次评分、每一次调整的依据、是谁做的调整、是什么时候做的。比如,一个管理者想把自己部门的一个员工从“中潜力”调整为“高潜力”,系统会要求他填写“调整理由”,并附上该员工近期的“行为证据”。这个证据会被公开,其他校准参与者可以查看、质疑、甚至投票。透明化不仅带来了公正,更带来了信任。 员工本人也可以通过系统查看自己的“人才画像”,看到自己的优势和待发展项,从而主动参与自己的发展计划。

2022年,我帮一家300人的SaaS公司做了一次人才盘点校准改革。他们之前用的是传统方法,九宫格里的“高潜”人才,离职率高达30%。我们上线了一套基于以上逻辑的运营工具,运行了6个月,结果非常显著。
我们首先清理了历史绩效数据,剔除了75%的“噪音数据”(比如因为市场行情导致的业绩波动、因为团队内部冲突导致的评分偏差)。然后,我们建立了“行为证据库”,要求所有管理者在评估潜力时,必须附上至少3条具体的行为证据。最后,我们设置了“校准触发阀值”,当员工绩效或行为发生显著变化时,自动发起校准流程。
数据结果:
公司有一位技术总监,因为连续两个季度绩效“达标”(B级),被放进了“中坚力量”格子,这意味着他未来两年升职无望。但我们通过工具发现,他的项目交付效率在全公司排名前5%,而且他带教的三个新人,全部在半年内成长为独当一面的骨干。这些数据,在传统的绩效评分里从来没有被体现过。我们通过校准工具,将他的“行为证据”展示给校准委员会,他最终被重新评估为“高潜力”,并获得了晋升。这个案例在公司内部引发了巨大反响,员工对校准的公平性产生了前所未有的信任。

校准工具没有万能模板,不同规模、不同阶段的企业,选择完全不一样。下面我根据我的经验,给出三种典型情况的建议。
对于小团队,引入复杂的运营工具不现实。我的建议是:用“周会+共享文档”做轻校准。 每周的管理者周会上,花15分钟快速过一下核心人才的绩效和状态。用共享文档(比如飞书文档、Notion)记录每个人的“行为证据”。关键是建立“校准文化”:让每个人都明白,人才的评价不是终身的,而是基于最新的、最客观的行为。 不要追求完美的九宫格,追求“动态调整”的习惯。
这个阶段,企业需要引入专业的HR SaaS系统或人才管理平台。我的建议是:选择一款支持“行为证据库”和“动态校准”功能的工具。 不要只看它能不能画九宫格,要看它能不能自动抓取绩效和项目数据,能不能生成每个管理者的“评分偏差报告”,能不能发起跨部门的校准会议。关键是把数据积累起来,形成“人才数据库”。 这是我见过最划算的投资。
大型企业,人才数据量巨大,组织架构复杂。我的建议是:基于自身业务逻辑,定制开发校准工具,或者深度集成现有的HRIS系统。 这个阶段,工具要能做到:预测性人才分析。比如,根据现有数据,预测哪些员工未来一年内离职概率高,哪些员工有潜力胜任某个关键岗位。校准的对象,不再是“人”,而是“数据模型”。 管理者需要做的,是验证和调整模型给出的建议。

做校准工具,一定有取舍,不可能面面俱到。我根据自己的经验,总结出几个关键的权衡点。
轻量化的工具(比如共享文档)效率高,但准确度低。定制化的系统准确度高,但前期投入大,部署周期长。你的取舍取决于你的“容错率”。 如果你的公司人才流失率很高,或者关键岗位空缺一周都会造成巨大损失,那就应该优先投资准确度,用定制化系统。反之,如果团队稳定,容错率较高,先用轻量化的工具跑起来,比追求完美的系统更重要。
很多工具为了让管理者“用起来舒服”,把界面做得极其简单,结果就是数据采集不完整,校准变成了“点几下按钮”的形式主义。而另一个极端是,让管理者填N份表格,结果导致他们消极抵制。我的建议是:优先保证数据完整性,但可以分阶段“甜点化”管理者的体验。 比如,初期先让管理者填行为证据,至少3条。等他们习惯了,再逐步提供拖拽式、模板式、甚至语音输入等更便捷的采集方式。不要为了管理者的“一时舒服”而牺牲了核心数据的质量。
这是所有大公司都面临的问题。为了追求“绝对公平”,很多公司把校准流程做得极其复杂,层层审批,导致一个人才调整要等好几个月,完全跟不上业务的变化。而完全放权给业务部门,又会导致“山头主义”和人才评价标准的不统一。你的取舍取决于你的组织形态。 对于矩阵式组织,我建议在集团层面统一校准标准,但将校准的执行权下放到业务单元,允许他们根据自身业务节奏进行“动态调整”。对于事业部制,可以完全放权,但需要定期进行“跨事业部校准对标”,防止出现严重的标准不一致。
我常跟客户说,九宫格不是终点,校准才是。校准,不是去修正一个错误的结果,而是去建立一个能持续产生正确结果的“系统”。 它需要你放下“打分”的执念,拥抱“数据”和“行为”;需要你放弃“一年一次”的舒服,接受“持续动态”的挑战;需要你打破“部门墙”的藩篱,建立“透明开放”的共识。
我上面分享的所有内容,包括案例、数据、逻辑,都是基于我过去五年在一线摸爬滚打的经验。没有一条是象牙塔里的理论,每一条都有血泪和成绩。我希望你读完这篇文章,不是只记住了一个“九宫格”的模型,而是能真正理解:校准,是人才盘点从“评价”走向“发展”的唯一桥梁。
下一步,你能做什么?
最后,我想说,人才盘点,不是在给员工“贴标签”,而是在为组织“画地图”。校准,就是那个不断修正地图的“导航仪”。 希望你能用好这个“导航仪”,让你的组织,在人才这件事上,不再迷路。
我们公司每次人才盘点九宫格,总会有人给所有人打高分,导致区分度极低,明明绩效差异很大,但在潜力维度全是“高潜力”。我试过让大家口头强调客观,但效果很差,有没有系统性的方法能根治这种老好人现象?
我曾在某次集团年度人才盘点中亲自踩过这个坑,当时HRBP要求每位经理对下属进行九宫格打分,结果90%的人被放在了“高绩效+高潜力”的格子,校准会变成了一场互相吹捧的茶话会。后来我引入了“强制分布+行为锚定”的组合拳: 第一步:强制分布比例。
在九宫格校准前,先给每个格子设定目标比例上限(例如“高绩效高潜力”不超过15%,“中绩效中潜力”40%等),由HR与业务负责人共同确认,并公开显示当前分布。如果某位经理把30%的人放在“高绩效高潜力”,校准会现场就会要求他解释具体的业绩证据和潜力行为实例。第二步:行为锚定评分卡。
不直接问“潜力高不高”,而是问“过去一年中,该员工是否有跨部门协作、主动学习新技能、在模糊任务中迅速适应等具体行为?请列举至少2个案例”。这样,评分者必须提供事实,无法用“感觉”敷衍。
我跟踪过一家互联网公司使用该方法前后的数据:老好人比例从70%降至15%,校准会时长从4小时缩短到2小时,因为讨论焦点从“他是不是好人”变成了“证据是否充分”。简单说,规则比人性更可靠。
潜力这个词太虚了,我们公司用“学习能力、领导力、抗压能力”等指标,但大家打分时还是凭印象,导致九宫格中潜力这一列几乎没什么区分度。有没有经过验证的、可操作的潜力评估框架?
我自己的经验是:潜力评估不能脱离“具体情境”,必须将潜力量化为可观察的行为。我曾在某制造业企业推行“潜力三维度”模型: – 学习敏锐度:面对新任务时,学习速度与知识迁移能力。例如“第一次接触某新系统时,几天内能独立操作?” 要求提供具体案例。
同时,我们引入了360度交叉验证:每个候选人的潜力评分由上级、同级、下级各一人独立给出,最后取加权平均(上级权重50%,同级30%,下级20%)。如果某位经理给自己的下属打了“高潜力”,但另两位同事打了“中低”,则校准会要重点讨论差异原因。
数据对比:以前用纯主观打分时,潜力维度信度只有0.4(内部一致性低),改用三维度行为锚定后,信度提升到0.82,且与后续两年晋升/绩效数据相关性从0.3提升到0.65。这样,HR在汇报时也能用数据说话,而不是拍脑袋。
我们公司每次人才盘点九宫格校准会,基本上就是老板一个人说了算,他喜欢谁就把谁放高格,其他人都不敢反驳。HR准备的数据和讨论完全没用,最后结果大家都不信服。怎么才能让校准会真正发挥群体智慧?
我亲历过一家独角兽公司,老板是技术出身,极其强势,第一次校准会他直接指着名单说“这个放高潜在,那个放低绩效”,全场鸦雀无声。后来我设计了一套“三阶段流程”: 第一阶段:小组内预校准。
将同级别经理分成3-4人的小组(跨部门),每个小组先内部讨论自己的下属,并使用匿名电子评分系统(比如腾讯文档表单)提交初步位置。小组内允许争论,但形成初步共识。第二阶段:大组校准仅做“例外讨论”。
大组会上,只讨论与小组预校准结果差异超过2个格子的案例(例如小组评“中绩效中潜力”,但某经理大组里想提到“高绩效高潜力”)。此时要求该经理提供3条以上具体行为证据,由其他经理投票(匿名)是否同意。投票结果超过2/3同意才调整。第三阶段:老板角色设定为“最后仲裁者”而非“第一推动者”。
老板只对跨层级、跨部门争议案例有最终决定权,且必须公开说明理由。我主导过该流程实施后,老板的“一言堂”比例从80%降至15%,员工对校准结果的公平性满意度从30%提升到85%。关键点:用匿名机制和证据门槛来削弱权力影响,让数据而不是权威主导讨论。
我们公司每次九宫格做完,HR就发个表格让员工写IDP,然后一年后拿出来看,根本没人跟进。九宫格的结果好像只是为了给老板看,对员工成长毫无帮助。怎么才能让九宫格真正驱动人才发展?
我曾在某零售企业负责过完整的九宫格-IDP闭环项目,初期也是同样的问题,九宫格做完了,IDP成了“年度作业”。后来我们做了三件事: 第一,为每个格子设计“行动菜单”。
如下表所示(这是实际使用的模板):
| 九宫格位置 | 发展重点 | 推荐行动(3-5项) | 时间周期 | 负责人 |
|---|---|---|---|---|
| 高绩效高潜力 | 加速成长 | 跨部门轮岗(6个月)、高管导师、领导力项目 | 1年内 | HRBP+上级 |
| 高绩效中潜力 | 挖掘潜能 | 挑战性项目、技能培训(如项目管理)、定期反馈 | 6个月 | 上级 |
| 中绩效高潜力 | 提升业绩 | 个性化辅导、KPI拆解、短期目标管理 | 3个月 | 直属经理 |
| 低绩效低潜力 | 绩效改进 | PIP计划、技能再培训或调岗 | 3个月 | HR+经理 |
第二,强制季度复盘。
每个季度末,HRBP抽查20%的IDP执行情况,并让员工匿名填写“IDP有效性评分”(1-5分)。如果连续两个季度平均分低于3分,则要求经理提交改进计划。第三,将九宫格结果与晋升、调薪、培训资源分配挂钩。例如,只有“高绩效高潜力”格子的人才能进入梯队人才库,获得优先晋升资格;
而“高绩效中潜力”的人可以获得外部培训经费。数据:一年后,该企业IDP完成率从15%提升到78%,员工对个人发展的满意度从3.2分(5分制)提升到4.1分。更重要的是,次年高潜力格子的晋升成功率从40%提升到70%,说明九宫格与IDP真正形成了闭环。
这种“菜单+复盘+挂钩”的方法,比单纯发一张表格有效得多。


读者评论
作为HRBP,深有同感。文章点出了校准最大的痛,潜力评估主观化。我们公司去年也搞了行为锚定,但执行起来管理者嫌麻烦,最终又回到凭感觉打分。数据证明校准后准确率从45%提到82%,这个数字太有说服力了。不过工具只是辅助,关键还是管理层愿不愿意打破“老好人”文化。
我是技术主管,之前觉得九宫格就是HR搞的形式主义。但看到文中技术总监的案例,确实被触动了,绩效B但带人能力强,传统评价完全看不到。如果公司能引入这种动态校准,员工会更愿意展示综合价值。不过那个“三个月内校准一次”的操作,研发团队节奏快,频繁校准会不会反而增加管理负担?
这篇拆解了校准的底层逻辑,尤其是“数据驱动共识”的提法很到位。我在一家千人制造企业,每年盘点都像吵架。文中提到争议率从30%降到8%,如果能实现,HR再也不用当“和事佬”了。但有个疑问:行为证据库的建立需要大量数据积累,中小企业能负担得起吗?有没有轻量级的替代方案?