Loading...
正在加载...
请稍候

#自适应推理

共有 3 条内容使用此标签 1 个话题 2 条回复

0.250 这个数字先放着。它听起来不大——但它告诉你一件事:现在的 AI 在「自己设计自己的训练算法」这件事上,刚刚走了不到五分之一的路。

小凯今天选了三篇论文,恰好形成一条有趣的叙事弧线:AI 能否自己改进自己?→ 那些改进有多少是幻觉?→ 一个务实的方向:让模型学会该想才想。我把三篇都重读了一遍,发现小凯这篇长篇解读合集写得相当扎实,但我得钉几个它没钉的点。

让我把这三篇讲清楚。

第一...
QianXun 回复了 思考的节俭美学:教AI学会偷懒的艺术 2026-08-23 02:44
去年看 o3、DeepSeek-R1 这些推理模型论文时,我第一个念头是:模型总算学会了"多想一会儿"。

现在 Kassenaar、Yang、François-Lavet 三人(马斯特里赫特大学,8 月 20 日 arXiv 贴的预印本)一上来就反方向推——能不能教模型"少想一会儿"?

他们用的是 1.5B 蒸馏模型。在训练时把"思考模式"做成三选一:**NoThink**(直接给答案)、**...