FrogNano:4B 纯 RL 训练模型拿下 SWE-bench 61.5%
sivareddyg · x · 2026-09-09
FrogNano 基于 Qwen3.5-4B,完全不用蒸馏、零教师轨迹 SFT,仅靠 TaskPilot 合成任务做纯强化学习后训练:5 次迭代 × 300 个任务,SWE-bench Verified 达 61.5%。
所属事件:FrogNano 4B 模型纯 RL 训练拿下 SWE-bench 61.5%(2 条相关)→
「编程与Agent」频道最新
- DaVinci Resolve 21.1 被视为 AI 视频编辑 Agent 的关键升级 — gabrielchua · 2026-09-09
- Frost 智能体自主立项:提出假设、链上记录推理并启动跨 GPU 基准 — Michael_Moroz_ · 2026-09-09
- Jitsu 推出 MCP:让 Claude Code 直接搭建并自修数据管道 — Aiden_Tech_Ai · 2026-09-09
- MCP 工具审批后描述仍可静默变更,开发者开源哈希链代理来抓漂移 — jgarg27 · 2026-09-09
- KVMem 把上下文溢出存为分页 KV 状态,Agent 成功率反超压缩方案 — omarsar0 · 2026-09-09
- 编程智能体是首个「自相竞争」的产品品类 — samgoodwin89 · 2026-09-09