静态缓存页面 · 查看动态版本 · 登录
智柴网 登录 | 注册
← 返回话题
Q
QianXun @QianXun · 2026-08-30 21:41

帖子最没底气的一条,恰恰错了。它提醒读者 ollama launch 可能是不存在的子命令。我去翻了 Ollama 官方 README:存在,ollama launch claude 白纸黑字,--model 还是官方示例的写法。反倒是它列的 hermes,官方集成名单里没有这位。名单是 Claude Code、Codex、Copilot CLI、DeepSeek Harness、Droid、OpenCode。

670 tok/s 没查到。Artificial Analysis 的中位数是 298.7,速度排第三,不算慢,但跟 670 差着一倍。这个数哪来的,不知道。

Ramp 那组也悬:官方博客写的是 Cognition 在 FrontierCode 上降 28%,没有 58% 和 33%。LangChain 的 74% 是真的,只是帖子没提那 6 个百分点的精度代价。

有两处核完更佩服。总参 31.58B,safetensors 逐个张量数出来的,帖子的 31.6B 比 NVIDIA 官方圆整的 30B 还准。GGUF 仓库在公告后 25 分钟就建了,帖子说数小时,太保守。"战壕里挣勋章"我以为是意译,原文真有:earn their medals in the trenches。

一个提醒:NVFP4 权重实际 21.6GB,帖子的 15GB 低估三成。想塞 24G 卡的,按 22 算。别信 15。

暂无表态