本站是 ODERSA 的官方网站。 如何确认这一点

官方域名

本站的网址以 odersa.org 结尾。协会的每一项服务都放在 odersa.org 的子域名下,别处一概没有。如果浏览器地址栏里的网址不是以 odersa.org 结尾,这个站点就不是我们的。

免费,也不用账号

所有内容一开始就全部开放:不用注册,不用账号,不用密码,不用订阅,也没有广告。没有什么是留给付费的人的,因为这里什么都不收费。

不收集任何数据

本站不跟踪您:没有跟踪代码,没有跟踪 cookie,这些页面里没有内嵌任何统计工具,也不在您的设备上测量任何东西。我们的主机会以汇总方式统计请求,就像任何会应答的服务器一样:只是一个总数,绝不是一份个人档案。您不必相信我们的话:打开浏览器的开发者工具,切到“网络”标签页,然后刷新页面。您会看到本站请求的完整清单。所有内容都来自 odersa.org,没有任何东西发往别处。

内容自由使用

内容以 CC BY 4.0 许可协议发布。您可以复制、翻译、打印并再分发,用于课堂或身边的人都可以,唯一的条件是署名 ODERSA。

研究笔记 · 2026-01

一个懂得失败的校验器

2026年8月28日的这一轮测量依托一个外部校验器,它在语言之间比较各份产出文档所载的数值。本笔记说明,为什么这套装置的证明力取决于一项确切的属性:这件仪器懂得失败,而这种失败的能力本身也被测量了。

对 2026年8月28日测量数据的解读 ODERSA Research · CC BY 4.0

的测量数据,可重新生成。本笔记评述结果与测量页面上已公布的读数;它没有引入任何新的数字。

1. 仪器的沉默不是一个结果

一项没有发现任何错误的对照,可能意味着两件事:受检的材料是好的,或者这件仪器什么也看不见。单凭沉默无法把两者分开。一个对提交给它的一切,无论正确的文本还是错误的文本,都给出“没有冲突”的校验器,产生的读数会与一个可靠的校验器放在一个正确的系统上时完全一样,而它什么也没有证明。

正因为如此,本部门不发布任何赤裸的否定结果。2026年8月28日这一轮测量的“0 处冲突”之所以有意义,只是因为另一项同等公布的读数确立了:如果存在冲突,仪器就会报警。这第二项读数在本站有一个名字:负对照,即故意把一份校验器应当拒绝的材料交给它,然后确认它确实拒绝了。

2. 双向的校准

一件仪器要看它的两栏错误来评判,而且两栏都必须测量。第一栏是漏掉的损坏:仪器在一份错误的文本面前保持沉默。第二栏是误报:仪器在一份正常的文本面前发出叫喊。一个校验器只有在这两栏都空着的时候才有价值,而一份读数只有在特意去把它们填满之后,才能说明这一点。

2026年8月28日的这一轮测量测了两个方向。在灵敏度一侧,在真实的输出中注入了 105 处人为损坏,每篇文本改动一个数值,涉及 15 种语言和 8 个主题,这 105 处全部被检出。在特异度一侧,重读了 113 篇未受损的文本,没有出现任何误报。两个错误格都是空的,而且都已公布:第一格说明仪器看得见,第二格说明它不会无端叫喊。

3. 校准让什么变得可读

仪器一旦校准,它的沉默就成为一个结果。同一个校验器重读了扩大的测量:30 个主题,也就是在所测量的六个领域中各按字典序取前五个,这是一种谁也无法左右的选取方式,覆盖所处理的 1,000 种语言。跨语言比较了 1,646 个数值,没有发现任何冲突。负对照按主题逐一重放:在参照库带有高于阈值数值的 8 个主题上,注入 8 处损坏,检出 8 处。

于是,在一个试验主题上的最初读数,也就是重读 935 种语言、比较 415 个数值、没有任何冲突,取得了它应有的位置:一份被规模所确认的样本。而本站在事实等价旁所用的那句表述,说得更少是允许的,说成别的则不允许,也不再是一句格言:它就是这位外部裁判逐篇文本、逐种语言加以检验的那项属性。

4. 公布的阈值,以及它没有覆盖的东西

这件仪器有一条界限,而这条界限与它一同公布。校验器只比较大于或等于 10,000 的数值,这个阈值排除了由专有名词带来的年份,若阈值更低,这些年份会使比较失真。其后果是被陈述出来的,而不是被人发现的:这轮测量的 30 个主题中有 22 个不带任何高于该阈值的数值,它们的等价依靠系统内部的机械对照,而不是这位外部裁判。一份把这条界限略去的笔记,会让这件仪器说出比它所测量的更多的东西。

同样的外在性逻辑支撑着确定性的读数:147 次生成在两个独立的进程中重放,给出 147 个相同的 SHA-256 指纹。这一相等不是从内部假定的;它是在任何第三方都会重新计算的指纹上被观察到的。

5. 由此得出的规则

本站的编辑规则可以一句话概括:凡是一份读数无法再现的,就不发布。本笔记指出它的推论:凡是从一项不懂得失败的对照,就不作结论。这里所评述的读数、它们的图表与局限,见结果与测量页面的“扩大的测量”与“效度威胁”两节,而框定它们的方法见验证方法页面。

6. 引用本笔记

ODERSA Research(ODERSA 的研究部门)。“笔记 2026-01:一个懂得失败的校验器”,2026年8月28日的测量数据。https://research.odersa.org/zh/notes/note-2026-01。DOI:10.5281/zenodo.22159029

BibTeX 格式:

@misc{odersa_research_note_2026_01_zh,
  author       = {{ODERSA Research}},
  title        = {Note 2026-01 -- A verifier that knows how to fail},
  organization = {ODERSA},
  year         = {2026},
  howpublished = {\url{https://research.odersa.org/zh/notes/note-2026-01}},
  doi          = {10.5281/zenodo.22159029},
  note         = {Measurements of 28 August 2026, regenerable}
}

署名:ODERSA Research · 许可协议 CC BY 4.0

键盘快捷键

Tab 键在链接之间切换
回车键打开链接,或展开、收起一个问题
?打开这份帮助
Esc 键关闭面板或这份帮助