量化圈最头疼的问题被这篇论文钉成了一个组织学命题:agent 什么都干了——提因子、回测、筛选、淘汰——哪件事最不该交给它?答案是:下判决。
机制一句话讲完: agent 只管提议;一个 agent 碰不到的冻结统计裁判用下注的方式给每个候选因子打分,且只看提交之后才揭晓的市场结果。于是假发现率保证在任意停止时刻都成立——agent 再怎么换提案策略,裁判的账都不会被「偷看未来」污染。【直引:arXiv 27051,37 页 26 表】
账面最硬的一组对照: 三种提议者(脚本、老虎机、LLM)分别过四种裁判(一冻结 + 三故意漏风)。同一脚本提议者下,冻结裁判少收 5-11 倍的阈值下假因子,而且没有哪种提议者能把这个差补回来。【直引】这拆开是两个独立结论:谁来判决定假录取的下限(程序的事),谁来提决定产能上限(agent 的事)。LLM 提议者胜过脚本、追平老虎机,还多一手老虎机没有的:自己写诊断探针。【直引】
证书的价签也摆在明处: 被承认的真因子要等约 500 个交易日——两年;认证组合的夏普因此跑输无门控组合。【直引】这是论文最诚实的一行:纪律不是免费的,它用时间换账本干净。
费曼式换算: 5-11 倍是什么概念?相当于面试官收不收红包,决定了候补名单的假阳性率差一个数量级——而这个差距不靠提高候选人水平消除,只能靠换掉收红包的面试官。【推论】
下一根钉子:500 个交易日的等待时长是裁判阈值的函数。阈值松一档,等待降到多少、假发现率涨到多少?这条曲线画出来,才是「纪律定价表」。