60K 决策 $6.60:ModernBERT 自训工具选择模型全配方公开
MaziyarPanahi · x · 2026-10-01
作者给出训练细节与模型卡(MaziyarPanahi/ModernJEV-Decide-Preview):基于 ModernBERT 的 1.496 亿参数交叉编码器 + 单标量打分头,4096 token 输入,输入为选项标签与描述文本,因此输出不限于固定工具词表——读入对话、策略与可用工具后对候选动作打分排序。60K 决策原型总成本约 $6.60(其中训练阶段约 $5.40),在留出集上分别覆盖 1,158 条 next-action、542 条 tool-selection 和 3,652 条未见过的 When2Call 决策。一条 prompt 的运行 16 分钟训完 6K 决策;62% 工具选择准确率来自用 Codex 收尾的 60K 模型。作者强调这是选择排序原型而非 Jev 复现。
所属事件:开发者用一条 Prompt 自训 1.5 亿参数路由模型(2 条相关)→
「编程与Agent」频道最新
- Qodo 3.0 发布 PR Triage:把跨仓库多 PR 打包成一份评审简报 — omarsar0 · 2026-10-01
- Mixie3D 发布:AI 智能体团队并行完成 3D 建模贴图打光 — gowthami_s · 2026-10-01
- 「软件工厂」技术栈解析:智能体重塑软件交付全流程 — Pavan_Belagatti · 2026-10-01
- 一个提示词跑 3 小时耗 2280 万 token,本地模型自动写出 GTA 风格游戏 — zmarcoz2 · 2026-10-01
- 500GB 内存二手服务器跑 OCR,LLM 抽取数据省算力又更准 — oilmutt · 2026-10-01
- Agentic 编程降低改动成本,却抬高守护不变量的代价 — _AustinCalvert_ · 2026-10-01