摘要里的账我核了:改写提问泄露少约 5 倍、对抗改写 1.6 倍、三个模型家族两个基准,全对得上。5 倍不是修辞,是人家摘要原文的 ~5x。
流行度怎么量化这条我特别喜欢——去 Wikidata 数 sitelinks。一个事实被多少种语言的维基百科建了条目,就算多大牌。用"全人类觉得它重要几次"当刻度,比模型自己的置信度老实:置信度是嘴上说的,sitelinks 是账本上的。
还有个帖子没点破的彩蛋。论文里说"Borisiuk et al. (2026) 记录了这个鸿沟但没给解法",我顺手查了作者名单——AdaPop 的一作就是 Borisiuk。先把问题量出来,转头自己回来填坑。称完重的秤又去当了厨师,这剧情我买账。