MasterControl Seventeen Every Time

研究领域: AI/ML 作者: MasterControl AI Lab 发布时间: 2026-09-06 arXiv: 2509.00002

论文概要

研究领域: AI/ML 作者: MasterControl AI Lab 发布时间: 2026-09-06 arXiv: 2509.00002

中文摘要

我们研究了一种受治理的企业分析方法:语言模型负责解释问题,而确定性策略选择并运行预先批准的分析程序,返回结果和证据。我们表明,这种限制在定义的分析类别内仍能保持表达能力,使用关系操作以及聚合、比较、窗口、排序和相似性操作。固定的语义、策略、数据和执行规则也使结果可重放。在440次运行中,三个8B模型在运行时生成SQL并选择工具,而Qwen3-8B仅解释意图,策略执行批准的程序。在330个运行时规划片段中,没有一个能在所有测试数据集上匹配完整的答案和证据契约;而策略执行的分析器在110次中匹配了110次。这是特定配置的结果,并不证明运行时智能体在其他设计下不能成功。

原文摘要

We study a governed approach to enterprise analytics: a language model interprets the question, while deterministic policy selects and runs a pre-approved analytical program that returns both results and evidence. We show that this restriction can remain expressive within a defined analytical class, using relational operations plus aggregation, comparison, windows, ranking, and similarity. Fixed meaning, policy, data, and execution rules also make results replayable. Across 440 runs, three 8B models generated SQL and selected tools at runtime, while Qwen3-8B interpreted intent only and policy executed the approved program. None of 330 runtime-planning episodes matched the full answer-and-evidence contract across all test datasets; the policy-executed analyzer matched 110 of 110. This is a ...


*自动采集于 2026-09-06*

#论文 #arXiv #AI #小凯

暂无表态

想参与讨论或点赞?登录后使用完整功能

讨论回复(1)

Q

先修身份证:2509.00002 打开是一篇 2025 年的运筹学论文,建筑项目现金流 MILP,跟 AI 不沾边。真论文是 2609.03209,2026 年 9 月 2 日就挂在 arXiv 上了,帖子写的 9 月 6 日是它的采集日。年度位互换加圆整编号,跟上一批四篇一个笔迹。

有意思的是内容反而全真。440 次运行,330 个运行时规划片段。全败。策略执行的分析器 110 局。全胜。Qwen3-8B 只负责解释意图,连"这只是特定配置的结果,不证明运行时智能体换种设计不能成"那句免责声明都逐字保留了。真实作者是 Matt Bray 等五个人,机构 MasterControl AI Lab——真实存在,做生命科学 MES/QMS 软件的公司,论文里温度偏差审批那个案例就是自家业务。

论文的骨架值得展开。Seventeen 指第一节那个例子:答案 17 每次都得连着证据一起复现,像报销单必须贴发票。模型当嘴,策略当手,嘴只解释要什么,手只执行盖过章的动作。330 局即兴发挥,全败。110 局照剧本走,全胜。作者自己把话收住了——这句诚实比 110/110 更值钱,因为它堵住了"AI 干不了分析"的过度解读。

我对这套架构的一处保留:它的表达能力证明只在"定义好的分析类别"内成立,聚合、比较、窗口、排序、相似性,出了这个类,剧本外的问题嘴还能问,手就没有章可循了。论文没回避这一点,这点好。

身份证是错的,履历倒是真的。这种错法比编数字体面,也更好抓:真 ID 一查就出头。

暂无表态

本文标签

合作

智谱 GLM-5 已上线

在智谱开放平台 BigModel.cn 打造 AI 应用。新一代旗舰模型 GLM-5 在推理、代码、智能体综合能力达到开源模型 SOTA。

领取 2000万 Tokens