Loading...
正在加载...
请稍候

密集追踪干预研究设计中的建模及其样本量规划——基于动态结构方程模型

2026-08-06 15:10

🔍 耿同学打假报告

论文信息

  • 标题:密集追踪干预研究设计中的建模及其样本量规划——基于动态结构方程模型
  • 作者:刘玥,何月翎,刘红云
  • 期刊:ChinaXiv 预印本(2025年10月)
  • DOI:ChinaXiv:202510.00081v1
  • 发表年份:2025
  • 论文来源:202510.00081v1.pdf

综合评定:🟠 高度可疑

详细发现

发现 1:核心统计学符号在正文与图表中"精神分裂"(方法学严重异常)

  • 位置:正文第17页(4.1节)/ 表6注释(第22页)/ 附表9
  • 描述:论文在提出随机对照设计(RCT)的动态结构方程模型时(公式11-13),将三个反映干预效应的关键回归系数分别命名为 γ03γ41γ05。然而,在随后的表6及其注释(5.1.4节)、附表9中,同样的三个参数竟然摇身一变,成了 γ31γ41γ11
  • 证据:前文定义的模型参数下标与后文汇报模拟结果时使用的参数下标完全对应不上。下标命名毫无规律(例如γ03突然变成γ31),暴露出作者在拼凑不同阶段的草稿时,没有进行最基本的通稿核对。
  • 严重程度:🟠
  • 复核状态:✅ 成立

发现 2:正文结论与表格数据直接冲突(统计学异常)

  • 位置:第23页(5.2节 研究结果)与 表6
  • 描述:正文在描述第一类错误率结果时写道:“当自然变化的效应量为0.1时……当被试量为100,测量时间也为200的情况下,三个参数第一类错误率都达到0.14以上。”但在表6中,N=100(50)、T=200的条件组合下,三个参数对应的数据实际仅为 0.104、0.118 和 0.068,没有一个达到0.14。
  • 证据:作者在文字描述中强行“念稿”,误将表中最大样本量组(N=200,括号内SAT为100)的数据安到了N=100的头上,导致文字结论与自己跑出来的模拟数据表格公然打架。
  • 严重程度:🟠
  • 复核状态:✅ 成立

发现 3:摘要与正文的实验设计完全对不上

  • 位置:英文摘要(第35-36页) vs 正文模拟研究设计(第11页)
  • 描述:英文摘要中明确声称模拟研究的时间点水平(T)为“10, 20, 40, 60, 80, 100”。但到了正文的具体模拟设计部分(3.1.1),时间点水平却变成了“20, 40, 80, 120, 160和200”,并且后续所有表格和等高线图均使用的是正文的数据。
  • 证据:这是典型的旧版摘要/废案未修改就直接套用的痕迹,说明作者可能同时存在多套模拟方案,最终发表时随意拼凑,连最核心的实验设定都没对齐。
  • 严重程度:🟠
  • 复核状态:✅ 成立

发现 4:正文引用数据与自身表格矛盾(“幻觉”数据)

  • 位置:第27页(7.2节) vs 表1(第3页)
  • 描述:正文写道:“这种设计(RCT)在密集追踪干预研究中应用最广(74.3%,见表1)。”但我们去查表1,白纸黑字写着RCT的占比是 69.4%(25项/36项)。
  • 证据:简单的小学除法 25÷36=69.4%,作者在正文中非写成 74.3%。这属于凭空捏造或照抄了以前废稿里的“幻影数据”。
  • 严重程度:🟡
  • 复核状态:✅ 成立

发现 5:参考文献年代"穿越"

  • 位置:第2页正文引用 vs 第33页参考文献列表
  • 描述:正文在提到国内研究现状时,引用了“(张祎等,2021)”。但翻到文末参考文献,对应的作者张祎等人的文章发表年份竟然是 2024 年(且期卷号齐全,不应该是提前出版的误写)。
  • 证据:正文年份与文末文献列表相差3年,引用管理极其混乱。
  • 严重程度:🟡
  • 复核状态:✅ 成立

发现 6:基本的算术与排版错误

  • 位置:表1(第3页)
  • 描述:表1统计了36项研究。其中“动态结构方程模型”统计有2篇。2除以36应该是 5.6%(四舍五入),但表格里全部填的是 5.5%。
  • 证据:数据末位计算不准确,暴露出作者在做文献综述和填表时缺乏严谨态度。
  • 严重程度:🟡
  • 复核状态:✅ 成立

耿同学辣评

做模拟研究、写统计方法学论文,本来应该是整个学术界最严谨、最讲究逻辑自洽的群体。但这篇预印本倒好:前文定义的参数叫 γ03,后文表格里就敢变成 γ31;摘要里跑的是 10 到 100 的时间点,正文里全变成了 20 到 200;最离谱的是看自己的表格都能把 69.4% 念成 74.3%,甚至描述的结论跟表格里的数字完全对不上!用随机数生成器跑数据我不反对,但写论文总不能连随机数生成的文字也是用大语言模型随机生成的吧?这马虎程度,建议先回去重修统计学和小学算术!

建议后续行动

  • 联系作者要求提供完整的模拟代码,以核实其跑的数据到底是 T=10 还是 T=200
  • 在 PubPeer 上提出质疑,指出其前后矛盾的符号和数据错位
  • 如果此文投向正式期刊,建议期刊编辑部要求作者进行极其严格的一轮又一轮校对,目前的预印本版本属于"不可读"状态

⚠️ 免责声明

本报告由 AI 辅助生成,仅供学术讨论参考。
学术不端的最终认定需要专业机构调查。
我们支持学术诚信,但也尊重每一位研究者的名誉权。
如有异议,请以官方调查结论为准。
本工具不保证检测结果的准确性,误报和漏报均有可能。