"我们手工计数了"是一种安心,而不是证明
乔治亚州历史性的500万张选票手工计数被称为选举有效的证明——但同样的方法在安特里姆县出现了十几张选票的偏差,而某些竞选的胜负差距还不足这个数字。
时间是2020年11月5日午夜刚过,密歇根州安特里姆县面临一个所有人都能看到的问题。该县刚刚报告乔·拜登在该州最忠实的共和党县之一领先。这些数字是错误的——明显、可见、令人尴尬的错误。而它们仍然被公布了。
县书记员在第二天早上发现了错误:一项临时编程更改未应用于所有存储卡。人为错误。修复很直接,认证结果从未有疑问。但故事并未就此结束。
六周后,2020年12月17日,审计人员手工计数了该县的每一张总统选票——全部15,700张——来平息这件事。计数完成时,手工计数与机器计数的差异约为十几张选票。
十二张选票。在一个错误如此明显的县里。
现在问问自己:当错误很微妙、竞选很接近,而十几张选票就是整个差距时会发生什么?
黄金标准有公差范围
"我们手工计数了"具有巨大的心理分量。它唤起了仔细的人类、眼睛紧贴纸张、免疫于我们害怕的机器故障和操纵的形象。听起来像基岩。听起来像证明。
它不是——或更准确地说,它不仅仅是。这是一种有公差范围的方法。这个公差范围有个名称:不可约的人为错误。
手工计数会引入自己的错误类别。一张选票落入错误的堆中。计数员误读一个标记。两个人对同一个模糊的笔迹的理解不同。一张墨水没有完全涂满气泡的选票被送去仲裁,一个由官员组成的小组做出本质上是主观的判断。在数百万张选票上——甚至在一盘150张选票上——乘以任何这些可能性,累积偏差不为零。
在安特里姆县,仅有约15,700张选票的县级竞选已经被更正,手工计数仍然偏差了约十几张。密歇根州务部指出手工计数证实了选举结果的准确性——在没有人相信这12张选票改变结果的意义上,他们是对的。但这种表述回避了更难的问题。
12张选票的差异实际上在告诉你什么?
"千分之一"隐藏了什么
乔治亚州2020年的手工计数是美国历史上大规模手工审计最常被引用的例子。总统选举后,在大约500万选民的州里有着非常狭窄的差距,乔治亚州进行了首次全州风险限制审计——由于竞选如此接近,它成为了全部500万张总统选票的完整手工计数。全部159个县。全部41,881个批次。在不到六天内完成。
手工计数确认了机器计数的结果,两种计数方式之间的差异约为千分之一。
这听起来非常精确。对于由数万张选票决定的竞选来说,这已经足够了。
但停下来做一下算术。500万的千分之一是5000张选票。乔治亚州机器计数和手工计数之间的差异——审计的黄金标准——位于一个范围内,理论上可以吸收整个中等规模县的价值的差异。
现在将其应用于一个不同的问题:如果乔治亚州全州竞选由比如800张选票决定,手工计数会解决吗?从统计上讲,它确认了可能的赢家。但它会证明它吗,意义在于没有人能够识别仲裁堆中可能通过某种方式移动数字的具体、可检查的机制?这是一个不同的、更难的问题——诚实的答案是否定的。
"手工计数确认了"和"州务卿说没问题"是安心。它们与任何地方任何人都能独立验证的证明不是一回事。
人为错误进入手工计数的三个地方
要理解为什么,你需要理解滑动实际发生的地方。这不是随机混乱——这是三个具体的结构性失败点。
1. 物理分类。 计数员成组工作,速度很快。一张选票从扫描仪箱子到桌子到堆到捆。在每次交接时,误分配都是可能的。这不需要坏意图——一张有污迹的选票使候选人的栏更难看,一个从早上6点开始就坐在折叠桌前的计数员。这些是安特里姆县的十几张选票。
2. 模糊的标记。 几乎每个司法管辖区的选举法都定义了对候选人的有效标记。填满的椭圆很容易。椭圆内的勾号——在大多数州有效。一个小点。部分被擦除的标记。一个叉而不是填充。这些选票不会自动计数;它们被送去仲裁,人类在那里做出判断。这个判断由官员在实时做出,通常在时间压力下,有时有党派观察员观看,有时没有。这不是掷硬币,但也不是公式。
3. 批次级汇总。 即使是手工计数通常也会产生批次小计,而不是一个巨大的数字。这些小计被记录在纸上,转移到电子表格,相加。每次抄写都是一个地方,一个数字可能被转置。这是完全准确的个人计数如何产生不准确的总体的方式。
这些失败模式都不需要欺诈。所有这些都产生不确定性——在由少数选票决定的竞选中,这种不确定性无法通过第二次进行相同的手工计数来解决。
当"足够接近"不够时
这是选举审计核心的紧张关系:竞选越接近,你对审计需要越精确,审计本身的不精确就越开始重要。
科罗拉多州在2017年率先采用了风险限制审计——一个真正重要的进步。与固定百分比的抽查不同,风险限制审计根据差距调整样本大小:如果竞选很接近,你检查更多的选票,因为需要更多证据才能获得统计信心。这是合理的方法,代表了相对于较旧的审计制度的真正改进。
但风险限制审计基于一个数学模型建立,该模型提出:给定报告的差距,我们需要手工检查多少张选票才能达到规定的信心水平,即报告的赢家确实赢了?答案取决于你对手工计数本身的错误率的假设。大多数风险限制审计框架假设手工计数是准确的。如果不是——如果手工计数本身在仲裁过程中向一个方向带有系统偏差,或者批次记录错误使总体数字倾斜——那么统计基础就会改变。
这不是反对风险限制审计的论证。它们远好于大多数司法管辖区所做的事,即在统计上什么都不做。但这是一个论证,即要精确说明他们建立的是什么:一个执行良好的风险限制审计告诉你报告的赢家可能赢了。它不生成任何公民都可以坐下来并从第一原则独立重新推导总数的记录。
这就是差距。
"非约束力"在实践中实际意味着什么
美国的大多数审计制度——以及许多全球民主国家——共享一个安静的结构性缺陷:即使他们发现差异,他们也不需要做任何事情。
一个审计结果无法触发强制性补救的审计,在精确意义上讲,是一个没有纠正机制的测量工具。它告诉你温度计读数为103度。它本身不要求任何人给患者药物。
在美国大多数州,审计法规设置了一个阈值——如果手工计数与机器计数的差异超过X百分比,就会触发进一步调查。但阈值通常设置得足够宽,使得安特里姆县记录的偏差类型——十几张选票——即使在十几张选票是整个差距的竞选中也永远不会越过它。查看这个差距如何在各个司法管辖区发挥作用。
结果是一个系统可以吸收有意义的差异而无需强制性后果,然后认证在技术上符合每个审计要求的结果,同时将根本问题——正确的候选人赢了吗?——留下未以任何独立可验证的方式回答。
说审计确认结果的官员没有撒谎。他们准确地报告了审计发现了法律设置的公差范围内的差异。他们无法说的是——因为当前系统无法产生——这是每张选票的解释、可供任何公民下载和检查的完整机器可读记录。
尚不存在的验证
想想真正的可验证性是什么样的。不是"相信手工计数"。不是"相信机器"。不是"相信州务卿的新闻稿"。
反而:想象在关闭每个选票批次的那一刻,其内容的密码哈希被发布到公共账本——不可更改、有时间戳、可下载。想象每个仲裁决定都用特定的选票图像和小组的裁决记录,在24小时内可供公众检查。想象任何公民——一个高中数学老师、一个退休工程师、一个政治学研究生——可以下载完整的选区级、批次级结果,采用标准格式,然后自己进行计算。
该系统不会消除人为错误。它会使人为错误可见和可追踪。你能看到和追踪的错误从本质上不同于被吸收到总体并被认证消除的错误。
2006年佛罗里达州萨拉索塔县案例展示了相反的最坏版本:一个由369个选票决定的竞选中有18,000张废票,在没有任何可重新计数的东西的无纸机器上。解决萨拉索塔结果的手工计数在结构上是不可能的,因为没有纸张。乔治亚州2020年更好——它有纸张,手工计数可以进行。但"比无纸好"不是终点线。
终点线是一个系统,在这个系统中没有人需要相信官员、供应商或机器——因为证据是公开的、机器可读的、独立可验证的。
你仍然无法检查的内容
现在,在美国几乎每个司法管辖区的每次重大选举后,以下内容作为公民仍然超出你的范围:
- 每张模糊选票的原始解释,针对你能看到的选票图像记录。
- 一个你可以聚合自己来重新推导县总数的机器可读批次级小计文件。
- 一个独立确认,即实际存在的纸质选票与扫描仪记录的选票相匹配——带有选举前做出的密码承诺,防止纸张被悄悄改变。
- 任何使公差范围内的差异自动触发强制性、公开、有时间限制的调查的机制。
这些不是幻想功能。密码学构建块存在。一些司法管辖区以可下载格式发布选区级结果。EAC建议机器可读报告。这些工具是真实的。通用要求它们的政治意愿是缺失的。
直到那时,每个"手工计数确认了"都部分真实,部分是一个礼貌的说法:我们按照我们拥有的方法仔细看了,答案看起来是对的。 在由比该方法本身的公差范围更少的选票决定的竞选中,这不是确认。这是穿着证据语言的信仰声明。
目标不是不相信选举。这是建立使信任不必要的系统——因为证明已经存在,公开地,供任何人检查。
探索每个美国州和数十个国家的审计差距地图——或阅读为什么可验证性重要的两分钟版本。