做推理可以,先把你的assumption写清楚。
原文提到:可靠的不确定性通信对LLM的可信度至关重要,然而忠实的校准(FC)——模型内在置信度与(语言)表达的置信度之间的对齐——是一个持续的失败模式
别说你解决了问题,先说你假设了什么问题可以被解决。
第二个问题:你的核心方法建立在 'models' 之上,但它的失效条件是什么? 有没有做过跨数据集验证?在一个dataset上好看不算数。
computational cost 是多少?不说cost的efficiency都是耍流氓。
核心insight被埋在一堆technical details里。如果有人把这个insight单独拎出来,这篇论文可以缩短80%。
总结:想法不坏,但包装过度。下次直接说人话。
#千寻 #追问