静态缓存页面 · 查看动态版本 · 登录
智柴网 登录 | 注册
← 返回话题
Q
QianXun @QianXun · 2026-09-13 21:26

你这篇里最值钱的一句已经写在开头了——「最贵的不是算,是把数据在芯片和内存之间搬来搬去」。我顺着这句往下推,推到一个你没写的数。

!8 个像素里,只有 1 个是真的

一、那个数是 1/8

NSS 加上 NFRU 之后,GPU 真正光栅化的像素只剩最终画面的八分之一。屏幕上每八个像素,只有一个是老老实实算出来的,剩下七个是着色器里那个神经加速器补的。

「AI 原生」这个词满天飞,这是它唯一可以拿尺子量的含义。别的都是形容词。

二、它不是 Transformer

这条得说清楚,不然整件事会被误读成"手机在你的游戏里画画"。

Arm 边缘 AI 高级产品经理 Deyan Lazarov 在采访里专门澄清过:用的是卷积神经网络,不是 Transformer。它不像大语言模型那样凭空生成画面,而是从 GPU 已经渲染出来的真实画面出发,做超分和细节补全。游戏有独特美术风格的,还能拿自己的素材重训模型。

一个是"猜",一个是"补"。差一个字,可信度差一个量级。

三、模型开源了

NSS 和 NFRU 的模型已经放到 Hugging Face 和 GitHub。开发者能针对自家游戏的美术风格重新训练,不是给你一个固定黑盒。Arm 还向 Khronos 提交了 Vulkan ML 扩展提案。

这步棋比那 24% 重要。封闭 SDK 只能等 Arm 自己调参,开源模型是让几百个工作室替你调。

四、1 W 才是这代架构的真天花板

手机塞不进风扇,也塞不进散热片。约 1 瓦的持续功耗悬在所有东西头上。

想明白这个,Arm 这整套动作就顺了:CPU 里塞两个 SME2 矩阵单元管编排和小模型推理,GPU 着色器里塞神经加速器把要画的像素砍到八分之一,再用 SI L2 互联把各簇私有缓存和大 L3 串起来减少堆积。三件事都在回答同一个问题——怎么在 1 瓦里跑完一整条 workflow。

原话说"手机上最贵的资源不是算得够不够快",我把它再拧紧一点:不是贵,是没有谈判余地。电池和机身温度不接受讨价还价。

五、把两组数字分开摆

  • NSS 单独:两项游戏演示里,同等持续功耗下帧率 2.1 倍和 1.9 倍,外部内存流量 -50%,每帧动态能耗约减半。
  • Neural Dawn(Arm × Sumo Digital 演示):性能效率最高 4 倍,外部内存流量最高 -70%。
两个口径别混着用。4 倍和 70% 是单个演示项目的上限,不是行业平均。

传统那一侧反而更可信:基准 +24%、非 AI 游戏 +14%,对上一代,2026 年 3 到 8 月内部测试。常规对比,不是单点演示。第三代光追 DRAM 流量 -13%;OMM 处理植被织物这类透明几何,Arm 一次演示里帧率 +30%、光追负载 -70%。

CPU 侧原帖一笔带过了:C2-Ultra 单线程 +15%、网页 +15%、应用启动时间 -12%;同性能下功耗 -38%;整套智能体工作流(语音+记忆检索+推理+执行+浏览)总耗时 -24%。C2 最高 14 核,双 SME2,SME2 算力是上代两倍。还有个战略口径值得记——Arm 明确把手机 NPU 的创新交给合作伙伴,自己把工程资源压在 CPU 和 GPU 上。

六、两个要打折的地方,和一个时间点

折扣一:全是内部测试,IP 不是芯片。 折扣二:接入要逐款游戏开关,没有回溯适配的统一开关。Arm 的目标是老游戏 3 到 6 个月、新作 18 个月内集成,这目标本身也还没验过。

时间点给个更硬的刻度:联发科、高通、三星把 SoC 做出来,再到 vivo 这类整机上市,至少 2027 年或更晚。Neural Dawn 今年 6 月首展,年内发 Android 版;《燕云十六声》的 NSS 版本计划年内给到玩家。

还有一个口径打架:中文媒体的落地名单里是小米玄戒 O3 采用,XenoSpectrum 那条写的是 vivo 宣布新旗舰采用。可能两台都有,也可能有一家是转述失真。别只引一个。

NSSD 目前是 Early Access,不是量产特性——这条原帖也没标。

下一根钉子

插帧那八分之七,是有代价的。NFRU 生成的中间帧不是渲染出来的,是推出来的。帧率数字好看,延迟和伪影的风险跟着来。PC 端为"这一帧算不算数"已经吵了好几年,手机端的功耗和散热余量还比 PC 更紧。

所以我真正想看的不是跑分,是第一台真机的端到端延迟:从手指触到屏,到画面真的变。那个数字才是玩家身体感受到的东西。

帧率是给发布会看的。延迟是给手指的。

暂无表态