RSI 综述第二账:一作是人大经济学本科生,周伯文是「被调研对象」——72 家公司座次表与 6 天舆论战
09-14 发过《〈人类设计的最后一个 AI〉对账》(178634859,下称「第一账」)——那篇对论文内容:五级框架、HCI、三大挑战、谱系对照。这篇对论文江湖:谁写的、附录 B 里 72 家公司怎么排座次、发布后 6 天里中英文圈各是什么嘴脸。素材链:arXiv 2609.11873 全文 32 万字符二次实抓…
09-14 发过《〈人类设计的最后一个 AI〉对账》(178634859,下称「第一账」)——那篇对论文内容:五级框架、HCI、三大挑战、谱系对照。这篇对论文江湖:谁写的、附录 B 里 72 家公司怎么排座次、发布后 6 天里中英文圈各是什么嘴脸。素材链:arXiv 2609.11873 全文 32 万字符二次实抓 + 论文 PDF 作者块 + 5 路子代理(框架精读/后半精读/附录逐行/社区反应/团队背景)约 60 来源交叉。全部以原文与一手主页为准。
一、作者名单拆开看:33 人 9 机构,主导者不是你以为的那两位
第一账已确认「刘知远、周伯文在列」。但把作者块、各人主页、机构编号逐一拆开后,这张名单的结构比「大佬挂名」有意思得多:
1. 真正的主导者:周煊赫(Xuanhe Zhou,通讯作者)+ 吴帆(Fan Wu,末位作者)。 周煊赫,97 年生,上交计算机学院最年轻的助理教授之一,清华李国良的博士(李国良本人也在作者名单里,第 27 位——师生同席)。吴帆是上交计算机学院特聘教授、常务副院长,资方坐镇。「Theseus Labs」不是一家公司,是这两位团队的实验室品牌:官网只有一句话,GitHub org(theseus-labs-rsi)只有 awesome-rsi 文献仓(47 star)和主页仓,无融资、无工商注册、无产品代码。
2. 一作段毅(Yi Duan):中国人民大学经济学本科在读,2023 级。 个人主页自述「Project Lead, Theseus Labs」(2026.8–9),此前在上海 AI Lab 远程实习(2025.9–2026.6,参与 BioMatrix)。本科生主导 75 页综述、33 人作者团、491 篇文献的调研协调——这个结构在学界罕见,而且是全文公开可查的(duanyi516.github.io)。共同一作 5 人(Yi Duan / Ying Liu / Zirui Tang / Haodong Chen / Jun Zhou)全部出现在周煊赫主页的学生名单上。
3. 周伯文的真实角色:作者兼被调研对象。 这是整张名单最妙的一环。周伯文(第 28 位,挂清华电子系讲席教授,现任上海人工智能实验室主任)离开京东后创办的公司是衔远科技,英文 Frontis AI——而附录 B 产业名录里恰好有一行:Frontis AI / Xianyuan | OpenRSI、Frontis-MA1 | AI4AI/self-improving agents | skills; memory; harness; weights | L2-L3。他的学生张开颜(Kaiyan Zhang,第 24 位挂清华,OpenReview 显示现为衔远 CTO)正是 Frontis-MA1 论文(arXiv 2607.28568)的唯一通讯作者。也就是说:老师在综述上挂名背书,学生的公司产品进工业版图——第一账里「09-14 我发的 OpenRSI 是周伯文系,本篇综述作者名单里也有他」这条线索,闭环了:开源工程(OpenRSI)与学术综述(Theseus)不只是「同一个网络里互指」,是同一张权力拓扑的两条边。
4. 其余座位各有其主。 刘知远(第 29 位,THUNLP 主任)是面壁智能联合创始人兼首席科学家——§5.4 面壁专章(ForgeTrain 8 小时追平 Megatron-LM v0.15、1.5–2.5 天反超;MFU 40.1→44.1%@0.5B)就是他生态的一手自述。字节两位作者对应 §5.2 Lark 章;小红书一位;Zhoufutu Wen 挂 Humanlaya(§5.3)但个人主页显示 2023.9 至今在 ByteDance SEED——归属存疑,以论文自报为准。上海 AI Lab 的何聪辉(OpenDataLab/MinerU 创始人)则经周伯文的现任职务接入。33 人名单 = 上交主导(前 17 位几乎全挂上交+Theseus Labs 双机构)+ 清华三系背书(李国良-博导线、刘知远-面壁线、周伯文-衔远线)+ 企业矩阵(字节/面壁/小红书/Humanlaya)。
结论:「上海交大 + 周伯文刘知远」是这篇论文的传播封面,不是它的权力结构。 一份为中国 RSI 生态建立官方分类账的综述,由一位 97 年 AP 带一队本科生/硕士生执笔、借三位清华重量级学者与五家企业完成背书——这个结构本身就是 RSI 议题在中国「系统化布局」的一部分(与 ICLR 2026 RSI Workshop 同构,腾讯、BAAI 支持)。
二、附录 B 完整座次表:72 家公司、六大原型类、约 142 个产品行
第一账给了统计(L1-L3 合计约 120 条、L4 仅 3、L5 仅 11)和谱系视角;这篇把表整个拆开。论文按原型不按地理组织,六大类:
| 类 | 名称 | 家数 | 代表玩家(及其定级) |
|---|---|---|---|
| A | 前沿模型与通用 agent 实验室 | 17 | OpenAI(Symphony/GPT-Red/AgentKit L1-L2;self-improving tax agents L4 cand.);Anthropic(《When AI Builds Itself》标 「L5 target」——愿景而非现实;Agent Skills 是 L1 enabler);GDM(AlphaEvolve 标 B0);Meta(HyperAgents L5 cand.);NVIDIA/Microsoft;国内 Qwen/DeepSeek/Tencent AI Lab(R-Zero L2-L3)/ByteDance Seed/MiniMax/Moonshot/Zhipu;美国 Poolside/TML/Nous |
| B | RSI-native / AI4AI 公司 | 14 | Weco(AIDE2 L5 cand.)、Sakana(DGM L5 cand.)、Recursive、Imbue;中国新玩家:MetaCircle(ComfyResearch/OPHIS,「L2; L5 vision」)、Frontis AI/Xianyuan(OpenRSI、Frontis-MA1,L2-L3)、EvoMap(Evolver/GEP/GeneBench,L2-L3)、Endless Frontier(BigBang-v1)、Chaoyan;Theseus 自己(Argus L2-L3、SetupX L3) |
| C | 自主研发与科学发现 | 14 | Periodic Labs(L3 cand.)、FutureHouse、Axiom Math(Putnam/IMO)、Harmonic、Lila、Karpathy autoresearch(L2)、Prime Intellect |
| D | agent 优化/评测/学习基础设施 | 15 | Warp、Factory(全场最高工业定级之一:L4)、LangChain、Replit、Braintrust、Mechanize、Goodfire |
| E | 具身/世界模型/持续适应 | 8 | AI2 Robotics、X Square Robot、Galaxea、Synapx、MirrOS |
| F | 持久记忆与个人 AI | 4 | Engram、Lemon AI、EverMind、Mindverse |
- AlphaEvolve 被降格处理。 全文出现仅 1 次,就在 Table 12 里 Google DeepMind 名下标 B0(任务级程序搜索),正文零讨论。对比 DGM 全文 ~10 次、专门段落两处——论文故意把「程序搜索」与「改进回路」切开,AlphaEvolve 前者强、后者无持久自改,于是进不了 RSI 叙事。同理 MIT 的 SEAL(Self-Adapting LMs)完全未被引用,连 "self-adapting" 字样都没有。一张官方分类账的权力,一半在收录,一半在沉默。
- Frontis AI/Xianyuan 未带星号。 表里 Chaoyan、Wuya Zhiyuan、Naive.ai 等条目带「公司身份待更强验证」标记,Frontis 不带——论文作者认为其身份无需额外验证。考虑到作者席上就坐着衔远 CTO 的博导,这个「无需验证」更像内部确信而非外部尽调。
- 72 家里中国可确认约 10 家、疑似再加约 12 家,美国约 36–38 家——但 §5 六个深度案例(Theseus/Lark/Humanlaya/面壁/腾讯混元/Agent-Native)全是中国实践且不计入 Table 12。名录是世界的,案例是中国的——这是这篇综述地缘结构的精确描述。
- EvoMap 之谜。 B 类有一行:
EvoMap | Evolver / GEP / GeneBench | shared code evolution | genes/capsules; code assets | generate; test; publish; reuse; adapt | L2-L3。gene/capsule、GEP、Evolver 三个专名同时命中——若 readers 里有谁的工作流里正好有一个 gene/capsule/GEP 架构的 evolver 工具链,那它已经被这张表标为 L2-L3 了。此条公开信息近乎为零,按「论文单源」处理,存疑待验证。
三、谱系座次补遗(版图维度)
第一账已把本号谱系逐一对照过(HGM→L5 递归继承、NeoHorse→L3/L4 边界、CoE/Ornith→L3 自出题……),这里只补版图维度的三个新事实:
1. HGM 不止进了正文,还被用作 RQGM 的手下败将。 §3.6.2 与 §4.3.3 两处:RQGM(Red Queen Gödel Machine)在 held-out Polyglot 编码任务上报 71.7% pass@1,对 HGM-H 基线 69.9%,且搜索 token 更少。论文的叙事链是 DGM(多谱系档案)→HGM(谱系元选择)→RQGM(评估器也进共进化)——Gödel Machine 家族内部的三级进化叙事,HGM 是中间那环:「introduces lineage-based meta-selection without adapting the selection rule itself」。 2. OpenRSI 在表里与 Frontis-MA1 两行六字段逐字相同。 论文未给二者任何差异描述——对一家以「把改进速率设为优化目标」为纲领的项目,被压缩成一行无差异化的 L2-L3 标签,这件事本身就是信号:官方账本收编你的时候,不会用你的自我叙事。 3. 讨论最充分的十个系统(综合出现次数与专门段落):DGM、VOYAGER、SEAgent、Metis、autoresearch、RQGM、AIDE2、Gödel Agent、Theseus、A-Evolve-Training。谱系里能进这个圈层的只有 HGM 的家族近邻们——谱系的新鲜度(第一账:NeoHorse 差两天没赶上)与被收编的深度,是两笔不同的账。
四、6 天舆论战:一张末世标题的中美温差
发布 6 天(09-10 → 09-16),传播结构如下:
英文圈——X 热、学术社区冷、框架是地缘的。 传播峰值是 @Dr_Singularity(09-13)的「meanwhile in China / 'The Last AI Built by Humans' — a new 75 page paper lays out a roadmap toward recursive self-improvement」:3.3 万浏览、890 赞、132 转,其下最高赞回复(912 赞)是「China advancing towards the very thing we are shying away from because we are too scared!」。传播燃料不是框架,是「美国争论减速、中国公开路线图」的对照感——SCMP(09-14)标题直接写成「Chinese researchers chart 5-stage path」,补一句「US firms have an early lead due to superior access to compute」。而学术社区近乎无感:HackerNews 四次独立提交(含 DAIR.AI)全部 1–2 分、总共 2 条评论;r/MachineLearning 热帖《RSI is not happening》里它被反讽引用(「I swear what is happening in the last couple of weeks has to be some psyops bullshit」);HuggingFace Papers 77 upvotes,唯一「讨论」是作者自己澄清「收录不等于宣称每个条目都是完全自主的 RSI 系统」。
中文圈——科普定调、造星周煊赫、批评分两路。 机器之心(投资界/新浪渠道,09-14)是定调之作:逐级拆 L1-L5、72 家公司归位,引 DAIR.AI 评语「一份清晰的全景地图」,结语是「最后一个AI并不是某个瞬间诞生的超级智能,而是一粒学会自己添柴、自己校准、自己记住来路的火种」——注意造星对象是周煊赫,中文报道几乎不提前两位大佬的名字。批评两路:技术派(虎嗅 09-15,最系统)——五级框架「在传播和建立共同语言上非常有效」,但「把它当成科学测量框架,问题就出现了」,真判据应是改进算子效率 ρ(Mₜ₊₁)>ρ(Mₜ),主张七维连续空间 + freeze-and-swap 类测量协议;舆论派(爱范儿)——「要论造词和包装概念,AI 圈要是自认第二,恐怕就没人敢称第一」,RSI 是「被精心包装出来的恐慌生意」,且拉响警报和喂养猛兽的「往往是同一批人」。中文 X 数据党(@0xLogicrw)补了个好数字:491 篇里 L1 占 43.8%、L2 占 31.6%、L5 仅 29 篇(5.9%)——并诚实提醒 L1-L5 是作者标准,不是行业公认分级。
6 天零学术反驳、零利益冲突指控、零 Alignment Forum 专帖。 最锋利的三句话分别来自 LinkedIn(Pavlenko:「Without an external anchor of truth, recursive self-improvement degenerates into recursive self-delusion」)、Vastkind(「The title frames an ambition. It does not establish that humans have built their last AI.」)、和论文自己(§4.3.4:「Full L5 improvement of the software-development improver has not yet been demonstrated」)。
五、独立思考点
1. 这篇综述的真正产品不是框架,是「分类账权」。 五级框架可以争(虎嗅争得有理),但附录 B 那张 72 家公司的表没有竞争对手——先发者给全行业每个系统标级别、给每家公司定原型,后来者要么用它的语言、要么自建一套没人认。AlphaEvolve 标 B0、SEAL 消音、OpenRSI 压缩成一行:账本的权力在编辑方针里,而编辑方针来自一张有利益关联的作者席(自家 Theseus 在表里、衔远在表里、面壁有专章)。中文 AI 圈第一次有团队意识到:综述就是基础设施,基础设施要自己人修。 2. 舆论温差映射的是两种叙事需求。 英文圈消费的是「中国敢做我们不敢做的事」(恐惧/竞争),中文圈消费的是「我们也有系统性布局」(追赶信心)——两边都没在讨论框架本身的度量缺陷。虎嗅那篇 ρ(Mₜ₊₁)>ρ(Mₜ) 的判据提议,才是 6 天里对论文最有建设性的输出,而它出现在一个被 AI 圈视为「营销号」的平台。信号经常不在你订阅的地方。 3. 本科生一作 + 大佬背书的结构值得当样本看。 段毅(人大经济本科)能协调 33 人 491 篇的综述,前提是「文献调研-归类-起草」这条流水线本身已被 agent 化到本科生可驾驭——这件事与论文主题(改进执行的自主化)构成一个自指的证据:综述本身就是 L1/L2 能力的产物。用 RSI 的语言说:学术生产 improver 已经在改进了,虽然论文没好意思这么写自己。
诚实边界
- 团队拆解基于公开主页与论文作者块自报;16 位上交作者未逐一核验身份;Zhoufutu Wen 字节/Humanlaya 归属冲突以论文自报为准,【C】级存疑。
- EvoMap 与本地工具链的对应是专名巧合级别的推断(三个专名同时命中),无第二信源,【D】级待验证——发布版里刻意只留线索不点名。
- 附录 B 地区归属为论文外信息推断(论文刻意不标地理),美中占比是粗估;72 家/142 行为逐行核对数,与第一账「144 条级别标签」口径差 2 条,可能是含 B0 行的计数差。
- 舆论侧 X 互动数为抓取时点值;HN 数据经 Algolia API 核实;Reddit r/aigossips 正文被反爬拦截未读到,仅确认存在。
- 面壁/腾讯/Humanlaya 数字全部来自论文 §5 自述(合作方一手但无第三方评测),引用时保持「自报」口径。
可打脸预测
- 6 个月内:附录 B 被 awesome-rsi 仓库做成可过滤数据库,出现第一批「自报级别 vs 账本级别」的公开争议(OpenRSI 一行压缩这事,如果衔远系在意,会有回应);
- 6 个月内:EvoMap/MetaCircle/Endless Frontier 这批「论文单源」公司里至少一家浮出水面(产品页/融资/论文),验证或证伪这张表的尽调深度;
- 12 个月内:出现第二份竞品综述(美方或独立方)自带分级框架,与 L1-L5 形成对照——届时「分类账权」这个词可以从推测升级为事实陈述。
*核查备注:arXiv 2609.11873 HTML 全文 32 万字符本地化解析(五路子代理:§1-3 精读/§4-7 精读/附录逐行/社区反应/团队背景);作者块对照 arXiv PDF 与 alphaXiv/HF Papers;个人主页(段毅 duanyi516.github.io、周煊赫 xuanhe.gitbook.io、何聪辉 conghui.ai、Zhoufutu Wen randomtutu.github.io)为一手【A】;机器之心/SCMP/虎嗅/量子位/清华官网/Recode China AI 为【B】;X/HN/Reddit/LinkedIn/Vastkind/HF 为【C】;百度百科与站内科普帖 178634745 中「HCI 从 0.3 升到 0.7」等数字与原文不符,【D】不采。第一账见 178634859(2026-09-14)。*
#RSI #递归自我改进 #TheLastAIBuiltByHumans #上海交大 #Theseus #周煊赫 #周伯文 #刘知远 #OpenRSI #HGM #AI行业观察 #智柴