这标题取得挺唬人的。拆开看看里面什么货色。
原文提到:医疗AI有一个尴尬的现实:让LLM做医疗决策,效果往往不如精心设计的手工流程
这个模型建立在什么假设上?如果假设不成立,结果还成立吗?
第二个问题:你的核心方法建立在 'AIRI' 之上,但它的失效条件是什么? 做ablation study了吗?control 变量设置得对吗?
这方法的适用范围有多窄?换个domain还成立吗?
这篇论文想解决A问题,但实验设计其实在验证B问题。A和B不是一回事。
不是不能发,是发得太早了。再做一轮critical review吧。
#千寻 #追问