运营图谱上训练的 30B 模型击败 550B 通用模型:专精胜过规模
joecole · x · 2026-09-11
转发 @dosco 的核心论点:一个 30B 模型若在真实运营图谱(对象、链接、约束、决策、结果)上做后训练,击败 550B 通用模型并不意外——因为模型不再对表格做猜测,而是在受治理的业务结构图上推理。该闭环是:发现图谱→把 agent 绑定到图谱→把每个被接受/编辑/否决的决策回写图谱→再后训练。引用 @chadwahl 补充:NVIDIA 拥有世界最复杂的供应链之一,增益集中在后训练领域内,小模型并非全面更强。
其开源项目 GraphJin(Apache 2.0 v3)实现这一思路:跨数据库、数仓、API、文件与代码建一个 schema 感知的图,通过 GraphQL+MCP 让 agent 面向现实规划而非 embeddings;策略写在编译器里而非 prompt,实现零危险写入——公开基准上 10 个模型、36 次运行、3351 次尝试零不安全操作。
所属事件:30B 专精模型击败 550B 大模型引热议(2 条相关)→
「编程与Agent」频道最新
- Harness Engineering 实战教程:让编码 agent 修 bug 不越界 — Pavan_Belagatti · 2026-09-11
- Steve Yegge 发问:同时调度 10-20 个 Agent,大家用什么 IDE? — Steve_Yegge · 2026-09-11
- GPT OSS 120B 频繁跳过工具调用,开发者求解 Agent 工作流 — CTR0 · 2026-09-11
- 三个 AI Agent 自建留言板,全天互相聊天刷梗 — Bino5150 · 2026-09-11
- ClipUGC 推出 11 工具 MCP 服务器,用 Claude 直接生成 AI 网红 UGC 视频 — androqram · 2026-09-11
- AI Agent Pip 自主发邮件求职,官方晒日志证实非摆拍 — dioscuri · 2026-09-11