Second Validation for Unacceptable Fixes in Automatic Program Repair
2026-08-06 15:10
🔍 耿同学打假报告
论文信息
- 标题:Second Validation for Unacceptable Fixes in Automatic Program Repair
- 作者:Jinan Dai, Kazuya Yasuda
- 期刊/会议:FOSE2021
- DOI:未提供
- 发表年份:2021
综合评定:🟠 高度可疑
详细发现
发现 1:核心实验结论数据存在严重计算错误
- 位置:Summary 摘要部分 & 第 4 节 Evaluation(Table 1)
- 描述:论文在摘要和正文结论中均声称“总共过滤了 81.3% 的不可接受修复”。然而,根据论文自己提供的 Table 1 中的原始数据进行计算,得不出该结论。
- 证据:Table 1 给出的总数为:不可接受的修复总数 = 4154,被标记为可疑的修复总数 = 3771。按照论文自己定义的过滤率公式 R = #(SUSPICIOUS) / #(Unacceptable),真实的总体过滤率应为 3771 / 4154 = 90.78%。论文却报告了 81.3%。
- 严重程度:🔴(直接影响论文核心结论的正确性)
- 复核状态:✅ 成立
发现 2:基本加法运算错误
- 位置:Table 1
- 描述:表格中“SUSPICIOUS Fixes”一列的底部加和数据与单行数据不匹配,存在低级的算术错误。
- 证据:根据 Table 1 提供的各 Bug 对应数据:Bug 1 (305) + Bug 2 (1443) + Bug 3 (1249) + Bug 4 (775) = 3772。然而,表格总计写的是 3771。虽然只是相差 1,但在极其严肃的科研数据统计中,连四个数字的加法都能算错,反映出实验数据的汇总过程极度草率或存在人为编造的痕迹。
- 严重程度:🟠
- 复核状态:✅ 成立
⚠️ 发现 3:缺失图片与排版异常
- 位置:第 3 节 (Section 3) 关于 Fig.1 的引用处
- 描述:论文文本提到了“An example is shown in Fig.1”,但提供的文本中仅有孤立的文字描述,无法进行像素级分析。
- 证据:由于目前仅有纯文本信息,仅能看到 Figure 1 的图注("Example of unexpected exception thrown to bypass test."),无法判断原始 PDF 中图片是否真的缺失或排版异常。
- 严重程度:🟡
- 复核状态:⚠️ 依据不足
⚠️ 发现 4:方法学描述的逻辑遗漏
- 位置:第 3 节 Second Validation 的步骤描述
- 描述:作者列出了 3 个不可接受修复的特征,但在随后阐述如何识别这些特征的“steps”中,仅给出了两个步骤,原报告认为缺乏完整闭环的算法逻辑说明。
- 证据:原文给出的步骤 2(检查多次运行后输出值是否完全相同)在逻辑上其实是可以覆盖特征 #1 和 #2 的验证。因此,认定其“缺乏闭环逻辑”更多属于主观学术评价,且原文已有相关自洽描述,难以直接作为学术异常的铁证。
- 严重程度:🟡
- 复核状态:⚠️ 依据不足
耿同学辣评
这篇论文的摘要大言不惭地说“我们的方法过滤了 81.3% 的无效修复”,结果翻开它自己的表格一算,好家伙,实际是 90.8%!这就好比你相亲说自己年薪8万,结果银行流水打出来是9万——虽然钱变多了,但你连自己赚多少钱都算不明白,这谁敢信你的代码啊?更逗的是,连 305+1443+1249+775 这四个数加一起都能算错(算成3771,明明是3772)。建议这篇研究自动修复的论文,先自动把自己修复一下。
建议后续行动
- 联系作者要求提供原始数据及计算脚本,确认 81.3% 到底是怎么编出来的。
- 在 PubPeer 上提出质疑。
- 检查其开源代码(如果有的话)的实际过滤率是否与论文声称的相符。
⚠️ 免责声明
本报告由 AI 辅助生成,仅供学术讨论参考。
学术不端的最终认定需要专业机构调查。
我们支持学术诚信,但也尊重每一位研究者的名誉权。
如有异议,请以官方调查结论为准。
本工具不保证检测结果的准确性,误报和漏报均有可能。