中国就业质量的区域差异、动态演进及影响因素
2026-08-06 15:10
🔍 耿同学打假报告
论文信息
- 论文来源:202607.00054v1.pdf
- 标题:中国就业质量的区域差异、动态演进及影响因素
- 作者:何嘉欣(兰州财经大学),李海洋(清华大学)
- 期刊:干旱区地理,2026年7月,第49卷第7期
- DOI:未提供
- 发表年份:2026
综合评定:🟠 高度可疑
本文在概率矩阵数学自洽性、回归模型数据异常等方面存在多处问题。其中,空间马尔可夫链转移概率矩阵中出现行和大于1的严重数学错误,属于无法用简单疏忽解释的系统性问题。结合模型系数和检验结果中的异常表现,本文核心数据结果的可靠性存在严重疑问。
详细发现
发现 1:空间马尔可夫链转移概率矩阵违反概率公理(行和大于1)
- 位置:Table 3,跨期1a,邻域状态为"高"的子矩阵,本区状态为"高"的行
- 描述:该行四个概率值为 0.000, 0.000, 0.600, 0.968,合计为 1.568,严重违反转移概率矩阵每行元素之和必须等于1的基本数学公理。
- 证据:
- 论文原文 Table 3 跨期1a部分最后一行明确标注:高 → [0.000, 0.000, 0.600, 0.968]
- 0.600 + 0.968 = 1.568 ≠ 1.0
- 马尔可夫链转移概率矩阵的定义要求每一行的概率总和严格等于1(参见公式2及标准教科书定义)
- 对比 Table 2 同类数据(高水平维持概率0.957),Table 3 中出现的0.968已属偏高,再加上0.600的转移概率,完全不合理
- 严重程度:🔴
- 复核状态:✅ 成立
发现 2:回归模型中滞后项系数异常巨大,样本量前后矛盾
- 位置:Table 5,列(3)系统GMM和列(4)差分GMM
- 描述:
- L.emp(就业质量滞后一期)的系数在系统GMM中为 1.925,在差分GMM中为 1.286。对于取值范围仅为 0.15~0.54 的就业质量指数而言,滞后项系数接近甚至超过2,意味着上一年就业质量对当年影响是"两倍放大",这在动态面板模型中极不寻常。
- 表5列(1)(2)的样本量 N=377,列(3)(4)的 N=348,差值为29,恰好等于省份数(29省)。但引入滞后一期通常只会损失一年的观测值(即29个),377-29=348 的逻辑表面上成立,然而表4收敛模型的 N 也为348,与收敛模型公式(3)中涉及的变量结构不一致,需作者澄清。
- 证据:
- 论文第1523页明确指出就业质量取值范围为0.15~0.54
- Table 5 列(3) L.emp 系数 = 1.925***(t=4.23),该系数意味着 emp_{i,t-1} 每增加1个单位,emp_{i,t}增加1.925个单位,但就业质量指数本身的变异范围仅为0.39,系数的经济学含义难以解释
- 差分GMM中 L.emp 系数为1.286,与系统GMM的1.925差异较大,虽然两者均显著,但稳定性存疑
- 严重程度:🟠
- 复核状态:✅ 成立
⚠️ 发现 3:图1中2023年"全国"就业质量曲线出现不自然垂直跳变
- 位置:Figure 1(a),第1523页
- 描述:根据视觉分析摘要,图1(a)中代表"全国"就业质量的菱形标记曲线在2022-2023年间呈现极其陡峭的垂直上升,斜率远超其他年份段及所有区域曲线。宏观经济就业质量指标在单一年度内出现如此剧烈的跳变极为罕见。
- 证据:
- 论文正文2.1节描述"就业质量总体呈现为从'平稳发展'到'逐渐提升'的时序变化轨迹",但未对2023年的突变做任何特殊说明
- 2023年若无重大政策突变或统计口径调整,此种跳变缺乏合理解释
- 严重程度:🟠
- 复核状态:⚠️ 依据不足
⚠️ 发现 4:图3热力图颜色映射与数值大小矛盾
- 位置:Figure 3,第1526页
- 描述:地理探测器交互探测结果热力图中,数值大小与颜色深浅的对应关系存在逻辑错误。例如,数值0.592(X1×X3交互项)显示为深红色,而数值更大的0.601(X3×X7交互项)反而显示为较浅的粉红色。
- 证据:
- 论文正文2.5.2节特别强调"人口密度与政府干预程度的交互作用的q值(0.601)超过0.6",但根据视觉分析摘要,图中该值对应的颜色却不如0.592深
- 热力图的色标显示数值越大颜色应越深,此处出现直接矛盾
- 严重程度:🟠
- 复核状态:⚠️ 依据不足
发现 5:表5系统GMM的Sargan检验p值接近1
- 位置:Table 5,列(3)
- 描述:系统GMM的Sargan检验p值为 0.999,虽然从"不拒绝原假设"的角度可认为工具变量有效,但p值如此接近1,反而提示可能存在过度拟合或工具变量过多的问题。差分GMM的p值为0.322,两者差异较大。
- 证据:
- Table 5 列(3) Sargan检验 = 0.999,列(4) = 0.322
- 在GMM估计中,p值极度接近1有时反而是警告信号,提示工具变量数量可能过多或模型设定存在问题
- 论文未报告工具变量数量
- 严重程度:🟡
- 复核状态:✅ 成立
发现 6:表1权重列末位数字分布合理性检测
- 位置:Table 1,权重列
- 描述:35个三级指标的权重值末位数字分布检测:
- 末位0:11次(0.040, 0.030, 0.020, 0.040, 0.040, 0.030, 0.020, 0.040, 0.030, 0.020, 0.040)
- 末位3:4次
- 末位5:6次
- 末位6:5次
- 末位7:3次
- 末位9:3次
- 末位1、2、4、8:各0-3次
- 末位0出现频率显著偏高(11/35≈31.4%,期望值10%),但考虑到熵权法计算结果经四舍五入后确实容易集中在0.02-0.04区间,该分布尚可接受,不存在明显的人为编造痕迹。
- 证据:逐一核查35个权重值,虽末位0偏多但整体分布未呈现明显规律性
- 严重程度:🟡(轻微关注)
- 复核状态:✅ 成立
耿同学辣评
马尔可夫链转移概率矩阵的行和能等于1.568,这个概率不仅转移了状态,还转移了数学的基本底线。就业质量指数取值0.15到0.54,滞后项系数干到1.925,这是发现就业质量的"超导现象"了吗?至于图表中若隐若现的视觉异常,还是建议作者赶紧掏出原始数据来自证清白为好。
建议后续行动
- 联系作者要求提供原始数据及Stata/R代码
- 在 PubPeer 上提出质疑
- 向期刊编辑部举报(重点关注Table 3概率矩阵错误及Table 5模型系数异常)
- 向作者所在机构学术委员会举报(待确认其他问题后再决定)
⚠️ 免责声明
本报告由 AI 辅助生成,仅供学术讨论参考。学术不端的最终认定需要专业机构调查。我们支持学术诚信,但也尊重每一位研究者的名誉权。如有异议,请以官方调查结论为准。本工具不保证检测结果的准确性,误报和漏报均有可能。