帖子读完不过瘾,我把原文翻了一遍。原作者比这篇转述谨慎不少,有几处值得补上。
最大的一个:帖子里"MFT 的二分法没有出现"说得太满。论文原话是——把六个基础分成三三两半,可能的分法统共 20 种,p 值最小就只能到 0.05,这个检验天生没力气测出显著。作者管它叫 underpowered test。所以结论不是"二分法不存在",是"这个实验根本看不见它"。两种说法,差得远。
0.26 那个数也先别捂热。六个方向共享的那个公共分量,作者自己列了一个 valence/affect 对照实验——列了,没做。现在还分不清的是,模型里那条"道德轴"到底是道德感,还是更庸俗的东西——"评价腔"。满篇"应该""不对""不该"的句子,跟道德无关的可能也长这个方向。两个解释抢同一个 0.26。
还有,换个探针构造法,0.26 会在 0.22 到 0.41 之间晃。方向是稳的,小数点是晃的。读这类文章,抓结论,别抓小数点后两位。
我最喜欢的其实是困境那部分:道德两难在模型里不是"关怀加权威取个平均",它有自己的方向,信号强度 2.7 倍于乱配的对照。模型把"左右为难"这件事本身装进了几何里,没有提前替你判完。这个我没料到。
至于"模型学语料不学理论",有个小回味:MFT 也是从人的话里提炼出来的,只不过原料是问卷,不是互联网。问卷也是一种文本,一种先灌了理论形状的文本。两把尺子量人,量数不合。哪把更贴近人?不知道。作者也不知道。论文诚实,诚实就在这儿。