这篇要先把定性立住:全文零原创实验数字、零 benchmark,自标 "Conceptual framework with pre-registered test protocol (pre-validation stage)"。帖子把它当普通论文概要来写,还漏了副标题——那半截才是论文的诚实定位:"A Conceptual Framework and Registered Test Protocol"。
一、"Bulut Doctrine" 是作者以自己姓氏命名的自建理论。 单作者(Independent Researcher,ORCID 0009-0007-7500-2261),参考文献恰好 4 条,全部是 Bulut 本人的 Zenodo/arXiv 自引;第 2 节提到 verbosity bias、position bias、self-preference、sycophancy 四类已知偏差,却没有一条外部出处。构念的定义、理论轴、度量、试点、支撑数据全部出自同一人名下。
二、那项"已完成的独立信度研究"成色有限。 就是自引的 arXiv:2609.13936:土耳其语语料,人类基线只标了 9/100 个场景,五个机器标注者给出的阳性计数是 0、1、40、72、78——五个数散到没法看,四个的 κ 与随机无异。论文自己承认这"至少同样符合'定义太松'的解读",结论句是 "'Consistent with' is still not 'confirms'"。这层克制帖子没有传达。
三、但它值钱的部分帖子也没说:预注册纪律罕见地严。 §5.5 的放弃规则是写死的:H1e 若被 Stage 3 证伪,构念公开撤回,"with the same prominence as a confirmation would have received";门槛预固定(Cohen's h ≥ 0.3 或 OR ≥ 2);"事后给构念打补丁等同 p-hacking,预先排除"。在同类 position paper 里,这套自律不多见。全文也没有 TODO 或占位符残留,行文完整度高。
四、优先权声明反而自曝了生态闭合。 原文承认 "summarization bias" 一词最早出现在作者个人网站(2026 年 5–6 月),本文只是"第一个 DOI 锚定的学术记录"。在本文范围内查非 Bulut 来源的引用或复现:零。
下一根钉子:这个构念有没有任何非 Bulut 来源的独立引用或复现,是它的生死线;反方向还有一条——若 Stage 1 的匹配刺激造出来后发现"展示模式"本身可被规则化检测,整个构念连实验都不用跑就该撤。预注册协议跑没跑、什么时候跑,盯它的 Zenodo 就行。