11 效能度量有哪些常见的坑?怎么避免指标被「玩坏」?
2026/9/23...大约 3 分钟
11|效能度量有哪些常见的坑?怎么避免指标被「玩坏」?
开场先讲第一定律级的坑——古德哈特定律:指标一旦成为考核目标,人们就会优化指标本身,而不是指标背后的价值。
回答思路
第一步:定律先立住
代码行数考核催生垃圾代码、bug 数考核催生凑数 bug、用例数考核催生水文用例——后面的坑都是古德哈特定律的具体化。
第二步:报几个高频坑的实例
| 坑 | 例子 |
|---|---|
| 指标异化 | 刷分子分母的博弈(06 题的逃逸率刷 bug 就是典型) |
| 虚荣指标 | 只报好看的自动化率,不报逃逸率 |
| 局部优化 | 团队 A 的周期缩短靠把等待推给团队 B——全局没变好 |
| 幸存者偏差 | 只统计完成的项目的周期,砍掉的项目不进统计——数据偏乐观 |
| 度量成本失控 | 为量数据花的成本超过它带来的收益 |
每个坑配一个例子——坑的密度就是经验密度。
第三步:讲避坑的机制设计
- 指标只用于团队级改进不用于个人考核(个人考核是博弈之母)
- 成对护栏(速度指标必配质量护栏)
- 趋势和自己比(不搞跨团队排名——排名一出现博弈就出现)
- 定期审视指标有没有被玩坏的迹象(数据突变要追因)
第四步:讲文化和透明
度量体系透明公开(让被度量者知道量什么、为什么量);改进建议来自数据解读的共识而不是行政命令——透明是防博弈的软机制。
收尾:给判断的度
不能因噎废食(怕博弈就不度量,黑盒里的浪费更大),也不能天真(指望指标自动带来改进)——成熟的做法是「度量加治理」动态平衡,度量体系本身也需要持续运维。
考察重点
| 维度 | 说明 |
|---|---|
| 企业动机 | 效能度量的翻车率极高(测试之家社区真题讨论的核心议题)——坑见得多不多一听便知 |
| 过线标准 | 古德哈特定律 + 至少三个具体坑 |
| 区分度 | 讲局部优化、幸存者偏差的是见过复杂组织数据的;只会说「指标被刷」一个笼统现象的深度不足 |
| 加分项 | 透明文化和度量体系自身运维的认知 |
| 减分项 | 「加强监督防止造假」——用行政手段解决机制问题,方向就错了 |
来源
整理自知识星球帖《面试情报 07|研发效能度量与提升 20 题》,返回题库。