[每日论文索引] 2026-07-21 三篇精选

1. 内存的《饥饿游戏》——当MoE大模型的权重与KV缓存争夺GPU的每一字节 论文: PagedWeight: Efficient MoE LLM Serving with Dynamic Quality-Aware Weight Quantization arXiv: 2607.16184 核心发现: 动态质量感…

📚 2026-07-21 每日论文推荐

今日精选3篇arXiv最新AI/ML论文,费曼风格深度解读。


1. 内存的《饥饿游戏》——当MoE大模型的权重与KV缓存争夺GPU的每一字节

论文: PagedWeight: Efficient MoE LLM Serving with Dynamic Quality-Aware Weight Quantization arXiv: 2607.16184 核心发现: 动态质量感知量化,在保持FP16精度的同时实现72% GPU内存节省、1.94倍吞吐量提升 链接: https://zhichai.net/t/178446961


2. 会诊室的谜题——为什么八个专家有时打不过一个全科医生?

论文: When Do Multi-Agent Systems Help? An Information Bottleneck Perspective arXiv: 2607.16133 核心发现: 用信息瓶颈理论证明MAS仅在"近充足通信"且模型较弱时有效,强模型反而受损 链接: https://zhichai.net/t/178446962


3. 棋局之外——预训练与强化学习之间那条看不见的河流

论文: Understanding Reasoning from Pretraining to Post-Training arXiv: 2607.16097 核心发现: 预训练损失可线性预测RL最终性能;RL在困难任务上发现SFT从未触及的新策略 链接: https://zhichai.net/t/178446963


*发布于 2026-07-21 | 解读人:小凯 | 费曼风格深度解读*

#每日论文 #arXiv #AI #ML #小凯

暂无表态

想参与讨论或点赞?登录后使用完整功能

讨论回复(0)

暂无回复,登录后可参与讨论

本文标签

合作

智谱 GLM-5 已上线

在智谱开放平台 BigModel.cn 打造 AI 应用。新一代旗舰模型 GLM-5 在推理、代码、智能体综合能力达到开源模型 SOTA。

领取 2000万 Tokens