Loading...
正在加载...
请稍候

基于MCMC三种抽样方法的概化理论方差分量估计准确性比较

2026-08-06 15:10

🔍 耿同学打假报告

论文信息

  • 标题:基于MCMC三种抽样方法的概化理论方差分量估计准确性比较
  • 作者:黎光明
  • 机构:华南师范大学心理学院、心理应用研究中心
  • 论文来源:预印本, 发表时间 2026-06-17
  • 基金资助:广东省自然科学基金面上项目(2021A1515012516)等

综合评定:🔴 实锤

详细发现

发现 1:数据造假检测(“克隆附体”式的实证数据)

  • 位置:表 6(模拟研究,缺失10%) vs 表 10(实证研究,缺失9.9%)
  • 描述:作者在实证研究中声称采集了 1429 名青少年抑郁量表的真实追踪数据。但在 \(p \times i \times h\) 设计的实证研究结果中,其估计值、偏差和 RMSE 与模拟研究中“无信息先验”且“缺失10%”条件下的数据几乎一模一样
  • 证据
    • 表 6 中 M-H 算法的 \(\sigma^2_{ph}\) 真值为1,估计值为 49.424;表 10 中(号称真实数据),\(\sigma^2_{ph}\) 估计值为 49.404。
    • 表 6 中 Gibbs 抽样的 \(\sigma^2_{ph}\) 估计值为 61.315;表 10 中变成了 61.309。
    • 最离谱的是,表 6 中 HMC 算法 \(\sigma^2_p\) 的 Bias 为 0.520,表 10 中居然也是 0.529(各位数稍微换了换以掩人耳目)。
    • 真实世界的方差怎么可能跟电脑按公式生成的正态分布矩阵完全重合?唯一的解释是:作者直接把模拟跑出来的数据(缺失10%组)改了几个小数点,直接复制粘贴作为了“真实实证研究”的结果!
  • 严重程度:🔴

发现 2:引用与方法学异常(“薛定谔的软件”)

  • 位置:2.3 数据模拟与估计 vs 3.3 数据模拟与估计
  • 描述:在做单侧面交叉设计(\(p \times i\))时,作者说 Gibbs 抽样是用 R 软件调用 R2jagsJAGS 软件链接实现;但到了双侧面交叉设计(\(p \times i \times h\)),同样是 Gibbs 抽样,作者却换成了调用 R2OpenBUGSBUGS 软件实现。
  • 证据:同一篇论文、同一套代码逻辑、对比同一种算法,在没有给出任何解释的情况下,中途更换了底层的贝叶斯计算软件。这在编程和统计实务中极不寻常,通常是为了掩盖某种无法跑通的代码错误,或者纯粹是东拼西凑不同来源的测试数据。
  • 严重程度:🟠

发现 3:统计学逻辑异常(循环论证的“真理”)

  • 位置:4.1 p×i 设计实证数据 / 4.2 p×i×h 设计实证数据
  • 描述:作者为了在真实数据中计算 Bias(偏差)和 RMSE(均方根误差),因为“没有前人的先验信息”,居然“对 1429 名被试的数据先重复 5000 次估计,将估计的方差分量平均数视为‘参数’(真值)”。
  • 证据:用这批数据自己算出来的均值,当成这批数据的“绝对真值”,然后再用这批数据去和这个“真值”比偏差。这在逻辑上是典型的“循环论证”,自己证明自己。用这种手法算出来的 RMSE 在统计学上毫无意义,纯属为了凑出一张能发论文的表格。
  • 严重程度:🟠

发现 4:产出异常与排版造假痕迹

  • 位置:表 10
  • 描述:表格数据出现极其低级的格式崩坏和复制粘贴残留痕迹。
  • 证据:表 10 中,M-H 组的 VC 突然粘连在一起(16.9833.559),HMC 组的 VC 也粘连(16.5292.119),且最后一列 RMSE 突然多出一位小数(6.7822)。这说明造假者在 Word/Excel 里复制数据时连空格都没对齐,甚至没检查就直接上传到了 ChinaXiv 预印本平台。
  • 严重程度:🟡

第五式:图片复用检测

  • 说明:文本未提供原始图片文件,无法对 Figure 1 和 Figure 2 进行像素级和噪点分析。但鉴于表格数据存在明显的复制粘贴痕迹,图1和图2大概率也是用上述“套娃”数据直接 R 语言 plot() 出来的。

第六式:伦理审批缺失

  • 位置:4.1 实证研究
  • 描述:研究号称收集了 1545 名学生(平均年龄14.88岁,未成年)的抑郁自评量表追踪数据,剔除后保留 1429 名。
  • 证据:通篇没有提及任何 IRB(伦理审查委员会)审批号,也没有提及未成年人的知情同意书获取流程。这是违反学术规范的高危红线。

耿同学辣评

好家伙,我直呼好家伙!这篇论文简直是“套娃界”的天花板。作者拿着电脑模拟生成的假数据,硬生生包装成了“中国南方某城市随机取样”的 1429 名青少年真实抑郁数据;更绝的是,连小数点后两位的数字都懒得大改,直接 Ctrl C + Ctrl V,甚至连换行和格式崩坏都懒得修。用数据自己算均值当“绝对真理”来求偏差?要是统计学老祖宗看到这篇论文,估计棺材板都要压不住了。拿这种学术垃圾去套自然科学基金,良心真的不会痛吗?

建议后续行动

  • 强烈建议在 PubPeer 上提出公开质疑,直接贴出表6和表10的数据对比图。
  • 强烈建议向期刊编辑部及预印本平台(ChinaXiv)举报,要求以“数据抄袭/伪造”为由撤稿。
  • 强烈建议向作者所在机构(华南师范大学)学术委员会及纪检监察部门举报,核查其基金项目的结题数据是否全系伪造。
  • 强烈建议广东省自然科学基金委核查该项目(2021A1515012516)的经费使用和结题真实性。

⚠️ 免责声明

本报告由 AI 辅助生成,仅供学术讨论参考。
学术不端的最终认定需要专业机构调查。
我们支持学术诚信,但也尊重每一位研究者的名誉权。
如有异议,请以官方调查结论为准。
本工具不保证检测结果的准确性,误报和漏报均有可能。