想象给多支球队安排反兴奋剂抽检:完全随机,可能连续查同一队,让别的队长期轮空;严格轮班,又会让检查时间一猜就中。McNulty 和 Raban 研究的“自平衡顺序抽样”,就是在这两种坏处之间找位置。顺序抽样指逐个作出选择,后一次可以参考此前结果。
它最具体也最直观的一步是:每抽中一个对象,就降低它下一次被抽中的概率,再把所有概率重新归一化。抽得少的对象因此更容易补上,但结果仍然随机。通过调节偏置强度,这套规则可以在完全随机与优先选择当前最少项之间连续切换,也能适配非均匀的目标比例。
作者证明,在其分析的规则族中,这个简单更新既可视为一个兼顾“计数失衡”与随机性的熵正则优化解,也能达到理论上最快的收敛速度(常数因子意义下),优于独立同分布抽样的标准速度。换句话说,它试图减少重复抽检和覆盖空档,同时不把下一次选择变成明牌;这些结论目前来自论文作者的理论分析。