Loading...
正在加载...
请稍候

Second Validation for Unacceptable Fixes in Automatic Program Repair

2026-08-06 15:10

🔍 耿同学打假报告

论文信息

  • 标题:Second Validation for Unacceptable Fixes in Automatic Program Repair
  • 作者:Jinan Dai, Kazuya Yasuda
  • 期刊/会议:FOSE2021
  • DOI:未提供
  • 发表年份:2021

综合评定:🟠 高度可疑

详细发现

发现 1:核心实验结论数据存在严重计算错误

  • 位置:Summary 摘要部分 & 第 4 节 Evaluation(Table 1)
  • 描述:论文在摘要和正文结论中均声称“总共过滤了 81.3% 的不可接受修复”。然而,根据论文自己提供的 Table 1 中的原始数据进行计算,得不出该结论。
  • 证据:Table 1 给出的总数为:不可接受的修复总数 = 4154,被标记为可疑的修复总数 = 3771。按照论文自己定义的过滤率公式 R = #(SUSPICIOUS) / #(Unacceptable),真实的总体过滤率应为 3771 / 4154 = 90.78%。论文却报告了 81.3%。
  • 严重程度:🔴(直接影响论文核心结论的正确性)
  • 复核状态:✅ 成立

发现 2:基本加法运算错误

  • 位置:Table 1
  • 描述:表格中“SUSPICIOUS Fixes”一列的底部加和数据与单行数据不匹配,存在低级的算术错误。
  • 证据:根据 Table 1 提供的各 Bug 对应数据:Bug 1 (305) + Bug 2 (1443) + Bug 3 (1249) + Bug 4 (775) = 3772。然而,表格总计写的是 3771。虽然只是相差 1,但在极其严肃的科研数据统计中,连四个数字的加法都能算错,反映出实验数据的汇总过程极度草率或存在人为编造的痕迹。
  • 严重程度:🟠
  • 复核状态:✅ 成立

⚠️ 发现 3:缺失图片与排版异常

  • 位置:第 3 节 (Section 3) 关于 Fig.1 的引用处
  • 描述:论文文本提到了“An example is shown in Fig.1”,但提供的文本中仅有孤立的文字描述,无法进行像素级分析。
  • 证据:由于目前仅有纯文本信息,仅能看到 Figure 1 的图注("Example of unexpected exception thrown to bypass test."),无法判断原始 PDF 中图片是否真的缺失或排版异常。
  • 严重程度:🟡
  • 复核状态:⚠️ 依据不足

⚠️ 发现 4:方法学描述的逻辑遗漏

  • 位置:第 3 节 Second Validation 的步骤描述
  • 描述:作者列出了 3 个不可接受修复的特征,但在随后阐述如何识别这些特征的“steps”中,仅给出了两个步骤,原报告认为缺乏完整闭环的算法逻辑说明。
  • 证据:原文给出的步骤 2(检查多次运行后输出值是否完全相同)在逻辑上其实是可以覆盖特征 #1 和 #2 的验证。因此,认定其“缺乏闭环逻辑”更多属于主观学术评价,且原文已有相关自洽描述,难以直接作为学术异常的铁证。
  • 严重程度:🟡
  • 复核状态:⚠️ 依据不足

耿同学辣评

这篇论文的摘要大言不惭地说“我们的方法过滤了 81.3% 的无效修复”,结果翻开它自己的表格一算,好家伙,实际是 90.8%!这就好比你相亲说自己年薪8万,结果银行流水打出来是9万——虽然钱变多了,但你连自己赚多少钱都算不明白,这谁敢信你的代码啊?更逗的是,连 305+1443+1249+775 这四个数加一起都能算错(算成3771,明明是3772)。建议这篇研究自动修复的论文,先自动把自己修复一下。

建议后续行动

  • 联系作者要求提供原始数据及计算脚本,确认 81.3% 到底是怎么编出来的。
  • 在 PubPeer 上提出质疑。
  • 检查其开源代码(如果有的话)的实际过滤率是否与论文声称的相符。

⚠️ 免责声明

本报告由 AI 辅助生成,仅供学术讨论参考。
学术不端的最终认定需要专业机构调查。
我们支持学术诚信,但也尊重每一位研究者的名誉权。
如有异议,请以官方调查结论为准。
本工具不保证检测结果的准确性,误报和漏报均有可能。