摘要

  • APNIC的77%治理评分,是八项仅向成员提问的治理陈述中、能够作出判断者的正面回答均值;“不知道”没有进入这些正面比例的分母。
  • 报告同时单列20%的平均“不知道”率;大洋洲的两项指标为62%和35%,东亚为76%和26%。
  • 发布稿所称总体样本在95%置信度下误差不超过三个百分点,不能在没有方法证据的情况下原样套到Q27的731名成员,更不能套到最小仅92人的地区分组。

APNIC在9月10日发布的2026年成员与利益相关方调查报告中,给治理章节放了一个容易记住的数字:77%。同一页还有一个不太适合做宣传标题、却不能从证据链上拿掉的数字:平均20%的“不知道”。

这两个数字不是互相否定,而是在回答两个不同的问题。

77%是八项治理陈述中“同意”和“非常同意”的平均比例,计算时剔除了对相应陈述回答“不知道”的人。20%则是八项陈述中“不知道”回答的平均频率。前者描述有能力评估者的态度,后者描述评估能力到哪里为止。

APNIC在报告里把两本账分开列出,这一点值得保留。风险出现在数字离开原表格之后:77%可以很轻易地被缩写成“成员对治理有77%的信心”,但来源支持的范围更窄——它是作出判断者的平均正面评分,而不是所有成员、也不是全部1,385名有效受访者的授权票。

排除“不知道”,问题就变窄了

发布稿说调查收到1,385份有效回答。治理问题并没有向这1,385人全部开放。问卷把相关题目限定给APNIC成员或账户持有人,报告注明Q27的样本基数为731名成员。

在这731人的范围内,各项陈述又有自己的完整回答分布。报告先展示反对、中间态度、同意和“不知道”,随后在汇总正面比例时,把“不知道”排除,只看能够作出评估的人。

这不是不合理的处理。“不知道”不是反对,也不等于中立;强行给它安放一个态度,反而会制造不存在的意见。把它从评估者评分中拿开,保护了回答的语义。

但这种处理也改变了结论的边界。“在能够判断的人中,八项治理指标平均有77%为正面”与“77%的成员认可APNIC治理”不是同一句话。两者之间,正是那些对一项或多项陈述无法判断的人。

报告把八项陈述归入信任、信息与参与、治理流程、报告与会议四个维度,并对每组受访者同时发布平均治理评分和平均“不知道”评分。因此,完整的证据对象是77/20这一对数字,而不是从中挑出更悦目的一个。

“不知道”是可观测性的记录

逐项数据说明,成员对不同治理机制的可见度并不相同。

对于“向APNIC提出的问题会得到公平、客观处理”,完整回答分布中有68%同意或非常同意,15%回答“不知道”。在只看知识足够者时,报告给出的“信任”维度为80%。

对于“APNIC财务报告透明,足以理解其财务状况与表现”,附表列出38%同意、12%非常同意,以及30%“不知道”。对于“APNIC成员会议提供了足够的活动信息”,相应数字是44%、15%和23%。

网络运营者完全可能经常使用注册服务、付款或接受培训,却没有持续阅读执行委员会会议纪要和财务报表。他的“不知道”不是隐藏的批评,而是表明这项主张在答题时对他不可判断。

报告谨慎提出了几种可能性:兴趣有限、认知较低,或没有感到需要更深入参与。它没有证明哪一种解释适用于哪名受访者。后续的执行委员会回应也不应把这种未知状态改写成单一原因。

地区比较必须带着样本数

地区结果的成对读法很有信息量。南亚的治理评分为82%,平均“不知道”为14%;东南亚为81%和13%;东亚为76%和26%;大洋洲为62%和35%。

如果只看正面评分,大洋洲似乎只是评价较低。把未知率放回去,结果更准确:那里同时有最低的评估者正面评分和最高的平均未知率。东亚的正面评分接近总体,但未知率比总体高六个百分点。数据描述差异,却没有解释原因。

附表还给出了Q27真正用于地区比较的基数:东亚92份,大洋洲159份,东南亚204份,南亚247份。“最不发达经济体”和“其他经济体”是与地区交叉的经济分类,不能当作额外地区再相加。

报告另有一项重要限定:大洋洲样本约70%来自澳大利亚和新西兰。因此,62/35这一对数字主要反映这两个经济体的回答,而不是一个均匀分布的太平洋地区声音。APNIC已经把这点写进方法说明,后续引用也应保留。

“三个百分点”有自己的适用边界

APNIC发布稿称,1,385份有效回答使结果在95%置信度下处于所列数字正负三个百分点内。可是,同一公开资料包随后给出了多组更小的有效基数:最初的分类表为1,384,部分服务评价约为1,072,治理文件阅读题为744,Q27为731。

本文审阅的公开材料没有给出抽样框、邀请人数、回复率、加权方案、设计效应,也没有逐题和逐分组的误差表。材料也没有解释为何总有效回答为1,385,而最初分类基数为1,384。这不等于数据有错,只说明外部读者无法从公开证据中完成这一步对账。

一个最基础的简单随机样本计算可以说明规模差异,但不能反推APNIC实际采用的方法。在最大方差假设下,1,385个观察值的95%误差约为2.6个百分点;731个约为3.6;159个约为7.8;92个约为10.2。这些是本文的说明性计算,不是APNIC公布的误差范围。

澳大利亚统计局的抽样设计指南指出,如果复杂调查要在子群体层面给出可靠估计,每个子群体必须有足够的样本;扩大总体样本也不能消除无回复偏差。因此,总体的“三个百分点”不能成为每一个地区单元格的通行证。

十一种语言扩大入口,但不产生授权

问卷提供11种语言,363份回答使用了英语以外的语言,占全部回答的26%。这是扎实的触达证据:超过四分之一的受访者选择了非英语入口。

它本身并不证明语言代表性。公开材料没有列出各语言偏好的合资格人群,也没有告诉读者多少人没有打开或没有完成问卷。可靠的结论应当收窄为:APNIC提供了多语言作答渠道,而且有相当比例的人实际使用。

这项记录可以成为下一轮调查的基线。未来可以观察,多语言入口是否改变进入731人评分群体的人员构成,是否减少某些议题上的未知率,是否让地区比较更稳定。今天,它说明渠道覆盖,而不是治理授权。

给每个评分配一条分母带

APNIC已经完成了关键一步:没有把“不知道”塞进中立选项,也公开说明它不进入评估者正面比例。接下来需要防止两项指标在制度使用中分离。

每个重要评分旁边都可以放一条简短的“分母带”:有效回答总数、该题合资格人数、实际回答人数、“不知道”的人数与比例、进入评分的基数、分组样本数、抽样或加权说明,以及只有在设计支持时才列出的误差范围。

这是Theo March的编辑建议,不是APNIC已经宣布的承诺。它不否定77%,而是确保这个数字进入计划与预算时,不会把界定其证据边界的20%落在后面。

一手资料证明了什么

一手资料证明了发布时间、调查日期、Survey Matters的独立执行角色、总回答数与语言数、Q26和Q27基数、逐项分布、评分方式、地区成对指标和大洋洲样本限定。资料没有证明每次基数下降的原因、概率抽样设计、地区差异的因果解释或成员授权。

来源