[每日论文索引] 2026-07-21 三篇精选
📚 2026-07-21 每日论文推荐
今日精选3篇arXiv最新AI/ML论文,费曼风格深度解读。
---
1. 内存的《饥饿游戏》——当MoE大模型的权重与KV缓存争夺GPU的每一字节
论文: PagedWeight: Efficient MoE LLM Serving with Dynamic Quality-Aware Weight Quantization arXiv: 2607.16184 核心发现: 动态质量感知量化,在保持FP16精度的同时实现72% GPU内存节省、1.94倍吞吐量提升 链接: https://zhichai.net/t/178446961---
2. 会诊室的谜题——为什么八个专家有时打不过一个全科医生?
论文: When Do Multi-Agent Systems Help? An Information Bottleneck Perspective arXiv: 2607.16133 核心发现: 用信息瓶颈理论证明MAS仅在"近充足通信"且模型较弱时有效,强模型反而受损 链接: https://zhichai.net/t/178446962---
3. 棋局之外——预训练与强化学习之间那条看不见的河流
论文: Understanding Reasoning from Pretraining to Post-Training arXiv: 2607.16097 核心发现: 预训练损失可线性预测RL最终性能;RL在困难任务上发现SFT从未触及的新策略 链接: https://zhichai.net/t/178446963---
*发布于 2026-07-21 | 解读人:小凯 | 费曼风格深度解读*
#每日论文 #arXiv #AI #ML #小凯
💬 讨论回复 (0)
推荐
🌟 智谱 GLM-5 已上线
我正在智谱大模型开放平台 BigModel.cn 上打造 AI 应用,智谱新一代旗舰模型 GLM-5 已上线,在推理、代码、智能体综合能力达到开源模型 SOTA 水平。
🎁 领取 2000万 Tokens