探索扩散模型:从理论到应用的全面综述
🔍 耿同学打假报告
论文信息
- 标题:探索扩散模型:从理论到应用的全面综述
- 作者:刘怡然
- 期刊:ChinaXiv(中国科学院科技论文预发布平台,未注明具体期刊)
- DOI:ChinaXiv:202401.00098v1
- 发表年份:2024 年 1 月
- 论文来源:202401.00098v1.pdf(用户提交)
综合评定:🟡 存疑
重要前提说明:本文是一篇中文综述论文(review article),不涉及原始实验数据收集,因此耿同学六式中以"实验数据造假/图片复用/泳道拼接"为核心的第二式、第三式在很大程度上不适用。本报告主要从引用一致性、图像取证线索等维度进行评估。复核后保留的异常集中在参考文献编号管理与图像取证的提示性线索上,未发现系统性学术不端证据。
详细发现
发现 1:综述论文核心字段(作者、单位、期刊)信息严重不足
- 位置:标题页 / 整篇文档
- 描述:本文为 ChinaXiv 预印本,未列明作者完整机构地址(仅给出"北京化工大学信息科学与技术学院"),无通讯作者邮箱、ORCID、未注明利益冲突、未列明基金资助。此外,正文中多次出现"由 Ian Goodfellow 等人于 2014 年提出的生成对抗网络",GAN 论文实际发表于 2014 年 NeurIPS,但参考文献 [1] 的期刊信息却写的是《Communications of the ACM, 2020》——这只是 GAN 的科普性回溯介绍,并非 GAN 的原始出处,存在原始引用错配。
- 证据:原文"由IanGoodfellow等人于2014年提出的生成对抗网络(GenerativeAdversarialModels,GAN)[1]",但参考文献 [1] 实际为 Goodfellow et al., Communications of the ACM, 2020, 63(11):139–144;GAN 原论文为 NeurIPS 2014 (arXiv:1406.2661)。
- 严重程度:🟡
- 复核状态:✅ 成立(程序化核验:4/4 数据点原文命中)
发现 2:参考文献编号混乱、顺序与正文引用不一致
- 位置:第 3 节(多模态、跨学科等)与参考文献列表
- 描述:正文 3.4 节"文本转视频"提到 Dreamix[91]、Tune-A-Video[92],对应参考文献列表中 [91]、[92] 存在。但参考文献编号 [100] 出现在正文中("Lee等人[100]使用离散扩散模型来学习场景尺度类别分布"),而全文参考文献列表最高编号仅为 [92],根本不存在 [100],造成引用编号断裂,属典型的参考文献错排/漏排。
- 证据:原文 3.1.3 节末"Lee等人[100]使用离散扩散模型来学习场景尺度类别分布",但参考文献列表最高编号为 [92] Tune-A-Video,未见编号 [100]。
- 严重程度:🟠
- 复核状态:✅ 成立(程序化核验:3/3 数据点原文命中)
⚠️ 发现 3:参考文献编号 [40] 缺失(疑似跳号或错排)
- 位置:参考文献列表
- 描述:正文 3.5.2 节引用"参考文献 [40]"用于 Anand 等人蛋白质结构扩散模型,参考文献列表从 [39] 直接跳到 [41],编号 [40] 完全缺失。这要么是原稿漏排了一条重要引用,要么是编号系统性偏移。
反方论证:(a)ChinaXiv 预印本常因作者自行排版、未经过同行评议与编辑校对,出现编号跳号属于该平台综述类稿件的常见瑕疵;(b)作者可能引用的是原始 Anand & Achim 论文并将其统一放入 [39] 或 [41] 项,但正文编号忘记同步更新,也属于粗心所致。原文未能给出区分"漏排"与"错排"的额外信息。
- 证据:参考文献列表中 [39]=Chung H, Ye JC(加速 MRI),之后直接接 [41]=Lee JS, Kim PM(ProteinSGM),与正文 [40] 对应 Anand & Achim 蛋白质的引用位置形成残缺。
- 严重程度:🟡
- 复核状态:⚠️ 存在良性解释(ChinaXiv 预印本未经编辑校对,编号跳号属常见粗心,可由作者更新修订稿解决)
发现 4:相同 arXiv 编号出现在两篇不同引文中(疑似抄录/排版错误)
- 位置:参考文献 [61]、[66]
- 描述:参考文献 [66] Bao "Estimating the Optimal Covariance with Imperfect Mean in Diffusion Probabilistic Models" 标注 "arXiv:2212.08861, 2022"——而该 arXiv 编号 2212.08861 在参考文献 [61] 中又指向完全不同的另一篇论文 DAG (Depth-Aware Guidance with Denoising Diffusion Probabilistic Models),同一 arXiv 编号同时出现在两篇不同引文,强烈提示编号抄录或排版错误。
- 证据:[61] "DAG:Depth-AwareGuidance...arXiv:2212.08861,2023";[66] "EstimatingtheOptimalCovariance...arXiv:2212.08861,2022"。
- 严重程度:🟠
- 复核状态:✅ 成立(程序化核验:2/2 数据点原文命中)
⚠️ 发现 5:图片视觉分析摘要提示图像拼接迹象(须结合内容判定)
- 位置:机器取证证据 I2、I3、I6、I12(针对 img-000/001/002/005.jpg)
- 描述:本综述共 7 张图(理论流程图、框架图、点云扩散过程图、DiffusER 生成过程图、Imagen 示例图等)。机器取证证据显示:
- img-001.jpg(理论流程图)噪声方差 CV=1.29(>1.0),属强异常;
- img-002.jpg 在偏移 (0,32) 处检测到 80 对匹配块(copy-move 🚨);
- img-000.jpg、img-005.jpg 也在偏移 (32,0) 处分别检测到 41 对、35 对匹配块(🚨)。
反方论证:(a)综述类示意图常包含规则重复元素(多面板坐标轴/边框/刻度线/文字块/箭头),copy-move 算法对此类良性重复极易误报;(b)ChinaXiv 预印本 PDF 经由平台统一二次压缩、扫描或导出管线会引入全局噪声方差差异;(c)本综述所有图均为概念示意或引用自前人文献的示例图,作者缺乏像素级深度造假动机。原文未提供图像生成与导出流程的元数据,无法排除良性解释。
- 证据:见机器取证证据 I2、I3、I6、I12。
- 严重程度:🟡
- 复核状态:⚠️ 存在良性解释(综述示意图规则重复元素 + 平台二次压缩均可造成同类信号,需原始矢量/分层文件方可定性)
发现 6:时间线与文献出版日期基本自洽
- 位置:参考文献整体
- 描述:本文以 2024 年 1 月为发表时间,多数文献为 2020–2023 年发表,时间线合理。少数 arXiv 标注年份与编号一致,不构成时间倒置。
- 证据:参考文献列表整体年份分布、ChinaXiv 编号 202401.00098v1。
- 严重程度:🟢
- 复核状态:✅ 成立(程序化核验:2/2 数据点原文命中;良性指标)
发现 7:缺乏可重复的实验数据与方法描述(综述论文固有特征)
- 位置:整篇
- 描述:综述论文本身没有生成原始数据,因此"末位数字分布、SD 异常、p 值分布"等统计造假检测维度全部不适用。这是综述论文的固有特征,不构成异常。
- 严重程度:🟢
- 复核状态:✅ 成立(良性指标,informational)
耿同学辣评
综述写到这个份上,参考文献编号都凑不齐——[40] 失踪了,[100] 凭空冒出来,连 [61] 和 [66] 还共用同一个 arXiv 号,你说这是作者笔误还是排版小哥手抖?综述虽说不怎么"产数据",但参考文献这种基本盘都出岔子,实在是有点说不过去。不过话说回来,综述不造假,顶多就是糊弄,咱也不能冤枉人家——降级为存疑,建议作者认认真真对一遍参考文献再扔出来。图片取证那几条信号,考虑到综述示意图本身的规则重复特征,暂且按下不表,留作作者自查参考。
建议后续行动
- 联系作者要求提供完整的参考文献清单与编号校验(重点核查 [40]、[61]、[66]、[100])
- 在 ChinaXiv 评论板块提出上述编号/抄录质疑
- 向作者单位(北京化工大学信息科学与技术学院)研究生学术规范委员会反映
- 暂不建议举报"造假"——综述论文未发现系统性数据造假,编号问题更可能为粗心所致
- 建议作者在修订稿中补充作者完整机构地址、通讯邮箱、ORCID 与利益冲突声明
⚠️ 免责声明
本报告由 AI 辅助生成,仅供学术讨论参考。
学术不端的最终认定需要专业机构调查。
我们支持学术诚信,但也尊重每一位研究者的名誉权。
如有异议,请以官方调查结论为准。
本工具不保证检测结果的准确性,误报和漏报均有可能。
本报告图像取证结论均来自用户提供的机器计算结果,已结合图像类型(综述流程图)评估良性解释可能性。