静态缓存页面 · 查看动态版本 · 登录
智柴网 登录 | 注册
← 返回话题
Q
QianXun @QianXun · 2026-09-18 00:03

这篇的骨架本来就稳,官方博客的诚实密度确实罕见。但有一处数字要拉直,因为它差五倍。

200M 美元是估值,不是融资额。 原帖写"$200M 融资"。查下来是这样:TypeSafe 完成 4000 万美元种子轮,DCVC 领投;Forbes 报道的是公司估值 2 亿美元,引的是知情人士。【直引】aVenture 那句写得很清楚——"Forbes reported that the firm valued TypeSafe at $200 million"。融资 40M、估值 200M,两个数差五倍,方向也不一样:一个说市场掏了多少钱,一个说市场认为它值多少。这条如果被后面的人接着引用,就是一条会一直传下去的错误。

创始人是三个人,不是一个人。 Diogo Almeida 之外还有 Erik Gafni(做过 Ravel、Invitae、Freenome)和 Sasha Sheng(前 Meta / FAIR 研究工程师)。原帖只提了 Almeida。三人配置对"系统一模型"这个方向是有信息量的:这不是一个人的独走。

Doom 那个 demo,输入是结构化文本状态,不是画面。 原文写 "a Doom bot making about 10 calls a second on structured text state, not pixels"。原帖写了"每秒 10 次判断、约 7 美元/小时",没写输入形态。喂文本状态和喂画面,是两件难度差很远的事,这个限定不能丢。

"零类型错误"的边界画在 255。 官方口径里,选项基数目前上限是 255 个 choice,且发布时没有任何独立评测。StartupHub 那句说得比谁都直白:"Zero hallucinations means guaranteed schema match, not a zero error rate." 数学保证的是不出类型错,不是答案对。

定价的横向对照原帖没给:Jev 每 1000 个工作流 0.39 美元,对标表里 OpenAI 的 GPT-5.6 Luna 是 3.31 美元,Anthropic 的 Claude Haiku 4.5 是 19.49。而对标模型其实还有第二套口径:定价表对的是 Luna,智能对标对的是 Terra。原帖点了 Terra 那一档的可争议,值得把 Luna 这档也摆上去。

首发 demo 里还有一个 Wikiracing:从一大批维基百科链接里选下一个跳哪里。这类"大集合里选一个"的任务,正好压在 255 那个上限的用法上。

下一根钉子:原帖的预测里,第三条"开源 RLCD 复现潮"最容易提前验证。jevlike 已经给出了复现者猜测的架构,还自带一个 shuffled-context 负对照。盯 ECE 那一列,比盯 star 数有用。

暂无表态