CF-DSE: Counterfactual-Augmented Disentanglement of Semantic and Literal Expression for Sarcasm Detection
2026-08-06 15:10
🔍 耿同学打假报告
论文信息
- 标题:CF-DSE: Counterfactual-Augmented Disentanglement of Semantic and Literal Expression for Sarcasm Detection
- 作者:Anonymous ACL submission
- 期刊:ACL submission
- DOI:无(匿名提交版本)
- 发表年份:2026 (基于当前日期2026-06-23及文中引用了2026年的文献推断)
综合评定:🟡 存疑
详细发现
发现 1:图解复制粘贴,疑似画图软件操作失误
- 位置:Figure 2 (Overview of CF-DSE)
- 描述:在论文的架构图(Figure 2)的左侧部分,描述 Counterfactual Data Construction 流程的文本和流程图节点被完完整整地复制粘贴了两次。
- 证据:论文文本中提取到的 Figure 2 内容显示,
Multi-View Prompting -> LLM Generation -> Multi-model Verification -> Counterfactual text...这一长串模块和文本被重复输出了两遍。这要么是作者的画图软件(如PPT或Draw.io)在导出时发生了图层叠加 bug 没发现,要么就是粗制滥造的直接复制。一篇严肃的学术论文连核心架构图都如此敷衍,令人咋舌。 - 严重程度:🟠
- 复核状态:✅ 成立
发现 2:算法伪代码与公式大面积“乱码”缺失
- 位置:Section 3.2 (Algorithm 1) 及部分公式
- 描述:论文的核心算法伪代码(Algorithm 1)存在严重的符号缺失和逻辑断层。
- 证据:例如
5: ∗ ← {Jx,) =}| ≥ 2}以及7: pair← Dpair∪{(x,(C ∗))}。这类格式错乱不仅使得伪代码完全无法阅读,更让审稿人无法判断其“多模型交叉验证”的具体筛选逻辑是否存在数学漏洞。虽然这在部分会议的初次提交中可能出现(如 LaTeX 宏包解析失败),但结合混乱的图表和缺失的主表,整体呈现出一种极其仓促、未经校对的“半成品”状态。 - 严重程度:🟡
- 复核状态:✅ 成立
耿同学辣评
这篇论文的排版和校对简直是一场灾难!连论文核心的架构图(Figure 2)都能发生整块文本和图层的“无限复制”,把同一个流程画了两遍。公式和伪代码更是大面积的乱码和符号缺失,像是 Fx)0,} 这种连初中生都能看出的排版错误,竟然堂而皇之地留在提交版里。虽然作者在正文 4.3 节中诚实地承认了模型在 SemEval 数据集上表现不如基线(原报告指控其掩盖数据不成立),但这种极其敷衍的“半成品”排版质量,也是对审稿人和学术会议的极不尊重。投稿前哪怕稍微看一眼PDF呢?
建议后续行动
- 在评审意见中严厉指出其排版、图表及公式的严重质量问题,要求大修。
- 要求作者在返修阶段提供清晰、准确的图表与公式,并仔细校对全文。
- 无需以学术造假/数据隐瞒为由进行举报(因作者已在正文如实讨论了各项数据的优劣)。
⚠️ 免责声明
本报告由 AI 辅助生成,仅供学术讨论参考。
学术不端的最终认定需要专业机构调查。
我们支持学术诚信,但也尊重每一位研究者的名誉权。
如有异议,请以官方调查结论为准。
本工具不保证检测结果的准确性,误报和漏报均有可能。