BTL-3 发布 27B 开源智能体编程模型,HumanEval 达 95.12%
soteko · reddit · 2026-07-23
Bad Theory Labs 发布了 BTL-3,一款面向 agentic coding 和工具调用 的 27B 开源权重模型,目标是让本地部署更轻量。
- 模型围绕完整 agent 循环设计:思考 → 行动 → 检查结果 → 恢复 → 继续。
- 还有一个紧凑版,单文件 8.39GB GGUF,不需要额外 base 模型下载或重建。
- 官方给出的成绩包括:HumanEval 95.12% pass@1、BFCL v4 AST 88.5%、多工具调用 95.5%、工具调用拒绝 91.2%。
- 他们称压缩后模型仍保留了 92.2% 的教师正确行为,并且在 RTX PRO 6000 上能跑到 43 tok/s。
- 模型权重、runtime 和源码今天都已开放,许可证分别是 Apache-2.0 和 MIT。
所属事件:BTL-3发布27B开源智能体编程模型(2 条相关)→
「编程与Agent」频道最新
- 有人想给软件工程任务建「形态分类」数据库,好按任务选模型 — StewartalsopIII · 2026-09-11
- 用 prompt 造硬件:一次对话让智能体组装定制设备寄到家 — paraschopra · 2026-09-11
- 模型之外才是关键:一文拆解 RAG 到多智能体的六大 AI 架构 — goyalshaliniuk · 2026-09-11
- 零基础开发者自建分层记忆架构,仅 20k token 记住一年对话 — matteoianni · 2026-09-11
- Warp 六个非工程团队全用 Linear 和 Claude Code 工程化运作 — mon__lim · 2026-09-11
- 九年后端老兵:AI 代码不比人写的差,变糟的只是速率 — Sweaty-Landscape-561 · 2026-09-11