Nanbeige4.2-3B 用 Looped Transformer 冲到 SWE-Bench 63.6
UsedMorning9886 · reddit · 2026-07-22
Nanbeige Lab 发布了 Nanbeige4.2-3B,这是一款基于 Looped Transformer 架构的紧凑型 agent 模型。
帖子强调它只有 3B non-embedding 参数,但在作者给出的表格里拿到了相当激进的结果:SWE-Bench Verified 63.6、SWE-Bench Pro 46.9。作者还称,在 OpenClaw + Lyzr Control Plane 的测试里,它在代码与日常工作流任务上压过了更大的 Qwen3.5 和 Gemma 4 级别模型。不过帖子也提醒:这些 benchmark 说法仍需外部复核,尤其是在 GGUF/llama.cpp/Ollama 版本传播之后。整体定位是一个轻量本地个人助手/agent 模型。
所属事件:Nanbeige4.2-3B 发布,Looped Transformer 架构主打 Agent 能力(5 条相关)→
「编程与Agent」频道最新
- 从聊天到 Agent,推理延迟正在成为生产级瓶颈 — Euphoric_Sea632 · 2026-09-11
- Anthropic 研究员:99% 工程师已跑 300+ 自改进 agent 群 — AlishaOutridge · 2026-09-11
- Gergely Orosz 观察:AI Agent 提速十倍交付,却带来一堆小退化 — ducha_aiki · 2026-09-11
- 同题 Echo Maze 实测:三大模型看似成功,代码里藏着同一个 bug — eyishazyer · 2026-09-11
- Astra 分镜+Minimax H3 分镜逐帧生成,视频创作成功率大增 — Hailuo_AI · 2026-09-11
- Codex 用户实测:Sol 搭配 Astra/Luna 子代理更省额度 — pvncher · 2026-09-11