运营图谱上训练的 30B 模型击败 550B 通用模型:专精胜过规模

joecole · x · 2026-09-11

转发 @dosco 的核心论点:一个 30B 模型若在真实运营图谱(对象、链接、约束、决策、结果)上做后训练,击败 550B 通用模型并不意外——因为模型不再对表格做猜测,而是在受治理的业务结构图上推理。该闭环是:发现图谱→把 agent 绑定到图谱→把每个被接受/编辑/否决的决策回写图谱→再后训练。引用 @chadwahl 补充:NVIDIA 拥有世界最复杂的供应链之一,增益集中在后训练领域内,小模型并非全面更强。

其开源项目 GraphJin(Apache 2.0 v3)实现这一思路:跨数据库、数仓、API、文件与代码建一个 schema 感知的图,通过 GraphQL+MCP 让 agent 面向现实规划而非 embeddings;策略写在编译器里而非 prompt,实现零危险写入——公开基准上 10 个模型、36 次运行、3351 次尝试零不安全操作。

所属事件:30B 专精模型击败 550B 大模型引热议(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →