如果所有考生都用最高规格监考,作弊会更难,但成本可能高得无法落地;如果规则太松,知道规则的人又会专门钻空子。这篇论文研究的正是这种两难:测试结果既受自然噪声影响,也会被受测者策略性操纵,怎样仍然选出真正的优胜者。
作者的关键做法像漏斗:先用较低安保等级测试,只有通过者才进入成本更高、安保更严的复测。模型假定,每名非优胜者都有一个需要多高监考成本才能被淘汰的门槛;组织者知道这些门槛的总体分布,却不知道谁对应哪个门槛。真正的优胜者则能通过任何等级的测试。在这些设定下,系统要共同决定测几轮、每轮用什么安保等级,并可依据前一轮结果调整下一轮。作者用动态规划——把大决策拆成一连串可复用的小决策——求总测试成本最低的方案。
它值得注意的地方,不只是“加强监考”,而是承认固定规则本身会成为作弊攻略,再把有限资源集中到越来越小的可疑或高分人群。结论的适用范围仍取决于论文的门槛模型与分布已知等假设。