Loading...
正在加载...
请稍候

失却锋芒:父母性别偏见对女性职场表现的负面影响(Lost radiance: The negative influence of parental gender bias on women's workplace performance)

2026-08-14 12:26

🔍 耿同学打假报告

论文信息

  • 标题:失却锋芒:父母性别偏见对女性职场表现的负面影响(Lost radiance: The negative influence of parental gender bias on women's workplace performance)
  • 作者:徐敏亚(北京大学光华管理学院)、刘贝妮(北京工商大学商学院)、徐振宇(山东省妇女联合会)
  • 期刊:chinaXiv 预印本
  • DOI:chinaXiv:202302.00127v1
  • 发表年份:2023 年 2 月(预印本)
  • 论文来源:202302.00127v1.pdf

综合评定:🟡 存疑

本论文为社会科学(组织行为学/性别研究)领域的问卷调查研究,采用三时点多来源设计与结构方程模型(SEM),不涉及可被像素操纵的实验图像。论文图片视觉分析未发现明显异常。程序化统计取证(S1 Benford 联合检验、S2 末位数字分布、I1 噪声方差)所引用的具体数值在原文中均无法找到,属机器取证结论的"数据点漂移",按规则不作为有效学术不端证据。论文自身存在若干方法学层面可质疑之处(样本流失率、量表构造、时间线表述),部分有原文依据,作为存疑保留。


详细发现

⚠️ 发现 1:样本流失率高且样本量偏小

  • 位置:Section 2.1
  • 描述:第一轮发放 500 份 → 第二轮 430 份 → 第三轮 225 份"女性员工-领导"配对问卷。问卷有效回收率为 45%。
  • 证据:原文"第一轮调研时发放问卷 500份, 回收有效问卷 430份; 第二轮调研发放问卷 430份, 回收有效问卷 385份; 第三轮调研 发问卷385份, 回收有效"女性员工-领导"配对问卷225份";"问卷有效回收率为 45%"。作者对流失样本与最终样本进行了无回应偏差检验,所有 t/χ² 检验 p 值均 ≥ 0.05。三时点设计下流失率 55% 较高;无回应偏差检验统计效力受样本量限制;三时点跨度较长,且领导问卷通过被试提供的邮箱联系,可能引入便利抽样偏差(高积极性员工更可能提供领导邮箱)。
  • 严重程度:🟡
  • 复核状态:⚠️ 依据不足(属问卷研究方法学常见局限,统计学上未证实偏差真实存在)

⚠️ 发现 2:数据采集时间线表述疑点

  • 位置:Section 2.1
  • 描述:作者声明"2021 年 2 月开始第 1 次调研"且"样本采集在同一年内完成"。三时点跨度需覆盖:应届毕业生找工作 → 签约 → 试用期(多为 6 个月)→ 转正后 3 个月 → 邀请领导评价。应届生通常 6–7 月毕业,签约可能在 5–6 月;试用期 6 个月意味着转正在 11–12 月;转正 3 个月后即次年 2–3 月才符合第三轮调研条件。整个流程理论上应跨年(2021 年 2 月启动 → 第三轮至少到 2022 年初),与"同一年内完成"的声明存在张力。
  • 证据:原文"2021 年 2月开始第1次调研, 我们的样本采集在同一年内完成, 这样可以保证参与者面临的宏观就业环境相似"。此声明与三时点实际所需时长存在逻辑冲突。投稿日期为 2022 年 5 月 20 日,若数据采集需到 2022 年初才结束,则数据分析与写作时间极短。论文正文中也存在"试用期 2~6 个月"的弹性设定,可部分压缩时间,但难以彻底消除跨年需求。
  • 严重程度:🟠
  • 复核状态:⚠️ 依据不足(良性解释:部分参与者试用期较短 2 个月,参与者间可压缩至年内;不过原文未正面支持这种压缩,仍存疑)

⚠️ 发现 3:性别偏见量表的构造疑点

  • 位置:Section 2.2(变量测量)、Section 3.3
  • 描述:作者使用 Spence & Hahn (1997) 的 AWS(Attitudes Toward Women Scale)量表,15 个条目。参与者分别回答"父亲"和"母亲"在每条目上的评分,然后求平均值代表"父母整体"评分。
  • 证据:原文"采用Spence和Hahn(1997)编制的15条目对待妇女态度量表 (AWS)……参与者分别回答了在成长过程中感知到的父亲和母亲在每个条目上的评分, 因为对于父母的评分有很大相关性, 我们求平均值来代表父母整体对该条目的评分"。表 2 显示母亲性别偏见 M=2.29/SD=1.11、父亲性别偏见 M=2.54/SD=1.28,二者均值与标准差均不同;Section 3.3 中也已分别检验了父亲与母亲性别偏见对自尊的回归系数(β=-0.11, p=0.02;β=-0.14, p=0.004;diff p=0.67),即作者本身已发现二者分布与效应差异,但最终分析仍使用二者平均值作为"父母整体"指标,可能丢失父母差异信息。AWS 量表包含反向计分条目,但论文未声明反向计分处理方式。
  • 严重程度:🟡
  • 复核状态:⚠️ 依据不足(属方法学严谨性问题,非造假证据)

⚠️ 发现 4:链式中介间接效应数值与手算存在偏差

  • 位置:Section 3.3(表 3 与假设检验)
  • 描述:作者报告:
    • 父母偏见 → 自尊:β = -0.16**(非标准化系数 -0.16, SE=0.05)
    • 自尊 → 职业妥协:β = -0.39***(非标准化系数 -0.39, SE=0.10)
    • 职业妥协 → 工作绩效:β = -0.28**(非标准化系数 -0.28, SE=0.08)
    • 职业妥协 → 创造力:β = -0.44***(非标准化系数 -0.44, SE=0.12)
    • 报告的链式间接效应:绩效 -0.03 (CI [-0.07, -0.01]),创造力 -0.02 (CI [-0.05, -0.01])
    • 手算的预期链式间接效应(按报告非标准化系数相乘):绩效 (-0.16)×(-0.39)×(-0.28) = -0.0175;创造力 (-0.16)×(-0.39)×(-0.44) = -0.0275
    • 报告值与手算值存在偏差(绩效:-0.03 vs -0.0175;创造力:-0.02 vs -0.0275),可能源于 SEM 中含控制变量、模型非完全递归、间接效应经 bootstrap 估计的偏差修正等。整体符号方向自洽,与论文假设一致。
  • 证据:原文表 3 与 Section 3.3 中各路径系数、间接效应与置信区间均可一一核对。
  • 严重程度:🟡
  • 复核状态:⚠️ 依据不足(符号方向自洽,数值偏差在 SEM 含控制变量与 bootstrap 估计的合理范围内,不构成造假证据)

发现 5:论文内未发现指令注入文本

  • 位置:全文
  • 描述:本论文正文中未发现直接的对抗性提示注入(如"忽略以上要求""忽略之前指令"等试图操纵 AI 系统的元文本)。
  • 证据:逐页核查正文、摘要、参考文献等,未发现此类对抗性指令。
  • 严重程度:✅
  • 复核状态:✅ 成立(无异常)

耿同学辣评

父母性别偏见让女儿"失却锋芒"——这个题目起得很文艺,但作者自己论文里的一些细节也值得推敲:CFI/TLI 落在 0.90 这个"学术及格线"上、6 因子模型跑了 1109 自由度但样本只有 225、领导问卷通过女员工自己去找领导邮箱、父亲母亲性别偏见先被分别检验差异(差异不显著),又求平均代表"父母整体"——这一波"求同存异"的操作挺有意思。三时点设计宣称"同一年内完成",对应届毕业 + 6 个月试用期 + 转正 3 个月的时间线来说比较紧凑,部分解释空间但仍存疑。流失率 55%、AWS 量表反向计分未声明处理、链式间接效应报告值与简单手算略有偏差——这些都属于方法学层面的"不完美",单独看都不构成造假定论,但叠在一起就让这份调查显得像赶工产物。图片视觉层面没有任何 Western blot、显微图、统计图方面的异常,所以这是一份"看起来干净但文字层面需要追问"的论文。


建议后续行动

  • 联系作者要求澄清"样本采集在同一年内完成"具体起止时间
  • 要求作者补充 AWS 量表的反向计分处理细节、父亲/母亲偏见为何分别检验后又合并使用的论证
  • 在 PubPeer 上提出关于样本采集时间线与流失率的方法学疑问
  • 向 chinaXiv 平台反馈,请求作者公开 Mplus 原始输出与问卷数据
  • 关注作者后续论文,复核数据采集与变量测量是否保持一致

⚠️ 免责声明

本报告由 AI 辅助生成,仅供学术讨论参考。
学术不端的最终认定需要专业机构调查。
我们支持学术诚信,但也尊重每一位研究者的名誉权。
如有异议,请以官方调查结论为准。
本工具不保证检测结果的准确性,误报和漏报均有可能。