Loading...
正在加载...
请稍候

MambaAD: Exploring State Space Models for Multi-class Unsupervised Anomaly Detection

2026-08-06 15:10

🔍 耿同学打假报告

论文信息

  • 论文来源:终极棒的参考文献!.pdf
  • 标题:MambaAD: Exploring State Space Models for Multi-class Unsupervised Anomaly Detection
  • 作者:Haoyang He, Yuhu Bai, Jiangning Zhang 等
  • 期刊/会议:38th Conference on Neural Information Processing Systems (NeurIPS 2024)
  • 发表年份:2024

综合评定:🟡 存疑

详细发现

发现 1:核心数据前后矛盾(正文与表格对不上)

  • 位置:Section 4.2 (Comparison with SoTAs) & Table 1
  • 描述:在正文第7页,作者写道:"our MambaAD outperforms all the comparative methods and reaches a new SoTA to 98.6/99.6/97.6..."。
  • 证据
    1. 然而在 Table 1 (Page 7) 中,MVTec-AD 数据集下 Image-level 的 F1_max 指标明明是 97.8,而不是正文里吹嘘的 97.6。
    2. 紧接着作者计算与 DiAD 的提升幅度:"improvement of 1.4↑/0.6↑/1.3↑"。我们来算一下:98.6-97.2=1.4,99.6-99.0=0.6,97.8-96.5=1.3
    3. 逻辑推理:作者在正文中引用提升幅度(1.3)是根据表格中的真实数据(97.8)算出来的,但手误(或复制粘贴旧版本数据)把正文的汇总数据写成了 97.6。这种核心结果的笔误反映出校对不严。
  • 严重程度:🟠

发现 2:拼写与语法错误频出(量产型特征)

  • 位置:全篇文本
  • 描述:文中存在多处低级的拼写错误和格式问题,显示出“赶工”或“复制粘贴”的痕迹。
  • 证据
    1. Table 1 标题 (Page 7):"Dateset Method" -> 应为 "Dataset"。这是表格表头,极为显眼。
    2. Section 4.2 (Page 7):"SoTA results onsixdistinct AD datasets" -> "on six" 之间缺少空格。
    3. Section 4.2 (Page 8):"experiments on MVTev-AD" -> 应为 "MVTec-AD"。
    4. Section 4.2 (Page 8):"as asIndex 8-12" -> 重复单词 "as"。
  • 严重程度:🟡

发现 3:数据“过于完美”的满分现象

  • 位置:Table A1, A13, A15 (Appendix)
  • 描述:在多个类别的对比实验中,MambaAD 取得了极其规整的 100.0 分。
  • 证据:例如在 Table A1 (MVTec-AD) 中,MambaAD 在 Bottle, Hazelnut, Metal Nut, Transistor, Grid, Leather 等多个类别取得了 100./100./100. 的满分成绩。虽然不是不可能,但在多类别无监督异常检测中,大量类别同时达到满分,且往往是唯一达到满分的模型,这种“完美压制”所有 SOTA 的数据有时会伴随着过拟合或数据集特定的 hack。
  • 严重程度:🟡 (需要查看代码验证)

发现 4:时间线异常(引用未发表/同月文献)

  • 位置:References
  • 描述:NeurIPS 2024 的投稿截止日期通常在 5 月份,但论文引用了大量 2024 年甚至疑似投稿后才公开的文献。
  • 证据
    1. 参考文献 [51] (J. Zhang et al., 2024) 的 arXiv 编号为 2406.03262(通常表示 2024 年 6 月发布)。如果 NeurIPS 2024 截止日在 5 月,引用 6 月份的文献存在逻辑冲突(除非是 camera-ready 版本添加,或者该文献投稿时就挂了出来,但编号规律略显突兀)。
    2. 参考文献 [21] (ZigMa) 编号 2403,参考文献 [28] (Swin-umamba) 编号 2402。这些工作都非常新,Mamba 架构本身(参考文献[15])也是 2023 年底才出。从 Mamba 诞生到做出如此庞大的实验(6个数据集,7个指标,无数消融实验)并在 2024 年初投稿,实验周期极其紧凑,符合“量产型学术”特征。
  • 严重程度:🟡

耿同学辣评

兄弟们,这篇论文生动诠释了什么叫“赶 DDL 的艺术”。Table 1 的标题都能把 Dataset 拼成 Dateset,正文里吹自己的分数是 97.6,结果算提升幅度的时候用的又是表格里的真实分数 97.8。这就好比卖车的时候宣传极速 300km/h,结果发动机参数表上写的是 280km/h,最后算百公里加速的时候又拿 300 去算,主打一个左右互搏。 这种连摘要和表格数据都校对不一致的论文,咱们看它的 SoTA 结果时,最好还是让子弹飞一会儿,去跑跑它的开源代码看看能不能复现再说。

建议后续行动

  • 运行其提供的开源代码,验证 Table 1 及 Appendix 中的具体数值是否能复现(特别是那些 100 分的项)。
  • 检查正文与 Appendix 中所有数字的一致性。
  • 在 PubPeer 上提出关于正文数据(97.6 vs 97.8)矛盾的 Question。

⚠️ 免责声明

本报告由 AI 辅助生成,仅供学术讨论参考。
学术不端的最终认定需要专业机构调查。
我们支持学术诚信,但也尊重每一位研究者的名誉权。
如有异议,请以官方调查结论为准。
本工具不保证检测结果的准确性,误报和漏报均有可能。