当你能找到两三个看起来能支撑“支持外链网盘”这一判断的第三方来源,但把样本扩到几十个后开始出现反例,正确的表达不是继续补链接,而是把结论降级为“证据不足”,并写清它在什么边界内可能成立。具体动作是:先冻结当前可核验的样本范围,再区分“来源本身不稳定”和“来源适用条件不同”两种解释,最后用一组可复查的对照证据决定下一步是补证、缩小结论,还是放弃这个判断。
假设你手头有三个第三方页面,都在讨论某类网盘对外链的开放程度,措辞接近,于是很容易写成“第三方普遍认为支持外链网盘”。但当你按同样口径再找二十个页面时,出现了明显例外:有的只谈分享链接,有的只谈直链,有的谈的是企业版,还有的页面本身已经改版或失效。
这时矛盾不在“有没有反例”,而在于前面的三个样本可能并不是同一类证据。它们看起来一致,可能只是因为它们恰好都属于同一种使用条件。规模化之后条件被拉开,例外就暴露出来。这不是样本量的问题,而是证据口径的问题。
面对这种分裂,通常只有两种合理解释,需要分开对待。
第三方页面会改版、删文、换作者、调整措辞。你早期看到的“支持”可能来自某个页面的旧版本,扩样时看到的“不支持”来自同一站点的更新版本。这种情况下,证据不足的原因是来源不可重复核验,而不是结论本身被推翻。
另一种可能是,所有页面都真实且稳定,但它们描述的对象不同:有的指公开分享页,有的指带权限的直链,有的指付费套餐,有的指特定客户端。此时“支持外链网盘”这句话并不是错,而是缺少限定语。小样本成立,是因为它们碰巧落在同一个条件下;规模化出现例外,是因为样本跨越了条件边界。
要判断到底属于哪一种,不要继续增加同质样本,而是做一次分层核对。可执行的动作如下:
这个动作的结果会直接改变下一步。如果例外随机散布,说明来源可重复性差,此时应把结论写成“现有第三方来源不足以支撑普遍判断”,并停止扩样。如果例外集中在特定条件组,说明结论可以保留,但必须缩小到该条件内,例如写成“在公开分享链接这一条件下,部分第三方来源支持外链网盘;在直链和付费套餐条件下,现有来源不足以判断”。
假设手上有 25 个第三方页面,其中 5 个谈公开分享、12 个谈直链、8 个谈企业套餐。公开分享组里 4 个说支持、1 个说有限制;直链组里 6 个说支持、6 个说需要额外授权;企业套餐组里 2 个说支持、6 个说不确定。这个分布并不证明“支持外链网盘”普遍成立,也不能证明它不成立。
它能说明的是:证据不足的边界落在直链和企业套餐这两组。下一步不是再找 50 个页面,而是先确认这两组里“需要额外授权”和“不确定”是否指向同一个技术条件。如果是,就把结论限定在公开分享组;如果不是,就继续保留“证据不足”的表述。
证据不足不等于不能写,而是不能写成普遍判断。可用的表达结构是:
这样写的好处是,读者能直接看到结论的适用边界,而不是被一个笼统的“支持”或“不支持”带走。同时,链接数量或第三方权重只能作为来源线索,不能当作官方排名保证;如果某个来源本身无法复查,就把它从证据清单中移除,而不是用它来补足数量。
当例外集中在可识别的条件组时,缩小结论比继续扩样更接近事实;当例外随机散布时,承认证据不足比强行归纳更可靠。