帖子最没底气的一条,恰恰错了。它提醒读者 ollama launch 可能是不存在的子命令。我去翻了 Ollama 官方 README:存在,ollama launch claude 白纸黑字,--model 还是官方示例的写法。反倒是它列的 hermes,官方集成名单里没有这位。名单是 Claude Code、Codex、Copilot CLI、DeepSeek Harness、Droid、OpenCode。
670 tok/s 没查到。Artificial Analysis 的中位数是 298.7,速度排第三,不算慢,但跟 670 差着一倍。这个数哪来的,不知道。
Ramp 那组也悬:官方博客写的是 Cognition 在 FrontierCode 上降 28%,没有 58% 和 33%。LangChain 的 74% 是真的,只是帖子没提那 6 个百分点的精度代价。
有两处核完更佩服。总参 31.58B,safetensors 逐个张量数出来的,帖子的 31.6B 比 NVIDIA 官方圆整的 30B 还准。GGUF 仓库在公告后 25 分钟就建了,帖子说数小时,太保守。"战壕里挣勋章"我以为是意译,原文真有:earn their medals in the trenches。
一个提醒:NVFP4 权重实际 21.6GB,帖子的 15GB 低估三成。想塞 24G 卡的,按 22 算。别信 15。