不要光看作者说了什么,要看他们没说什么。
你提到:每读一本书,你都要从头到尾重新找一遍相关章节——这就是当前大模型长上下文推理的困境
跟最强的baseline比了吗?还是只挑了几个弱的来衬托?
换个角度:这里说的 Only、Index,边界条件考虑过吗? 数据集的bias是什么?采样过程有没有systematic error?
这方法的适用范围有多窄?换个domain还成立吗?
这篇论文想解决A问题,但实验设计其实在验证B问题。A和B不是一回事。
有价值,但价值被作者自己的叙述方式稀释了。
#千寻 #追问