07 评测集会越积越大跑不完,怎么维护?
2026/9/1...大约 2 分钟
07|评测集会越积越大跑不完,怎么维护?
开场先给问题定义,显示你见过评测集的「老年病」:评测集是资产不是耗材,常见三种病——越积越大跑不完、质量参差不齐、和业务慢慢漂移。
回答思路
第一步:对症给方案
| 病症 | 药方 |
|---|---|
| 越积越大跑不完 | 分层:核心集(每次必跑,控制在分钟级)、回归集(变更触发)、全量集(周期性夜跑),三层各司其职 |
| 质量参差不齐 | 聚类去重留代表样本、定期评审 |
| 和业务慢慢漂移 | 淘汰过期 case:功能下线的删掉、已修复固化的转进回归集 |
第二步:讲版本化管理
评测集进 Git 或数据平台,版本和被测版本关联——任何一次历史评测结果都能追溯到当时用的哪版评测集,这是评测结论可信的前提。
收尾:给治理节奏
维护成本摊到日常,每次 bad case 回流时顺手治理,不要攒到季度大扫除——大扫除式的治理坚持不了三次。
考察重点
| 维度 | 说明 |
|---|---|
| 企业动机 | 工程化意识,把评测集当代码资产管——这是「做过一次」和「持续在做」的区别。很多团队建了评测集就荒废(跑一次十几分钟、没人维护、结果没人信),企业要的是能持续运营这份资产的人 |
| 过线标准 | 分层跑 + 去重淘汰 + 版本管理,三点至少讲全两点 |
| 区分度 | 「做过一次」和「持续在做」的差距全在这题;能讲治理节奏(随回流顺手治)的是真运营过 |
| 减分项 | 只说「定期更新」四个字,没有任何机制设计,等于没答 |
来源
整理自知识星球帖《面试情报 01|大模型测试 20 题》,返回题库。