评测显示 OpenCode 会让开源模型变笨,Pi 框架表现领先
PMinervini · x · 2026-08-27
一项针对本地 LLM 与编码 Agent 框架的基准测试显示,使用 OpenCode 会导致开源模型性能下降,而 Pi 框架则在 SWE-Bench 上取得了领先优势。测试对比了 Red Qwen 3.6 35B-A3B 在不同框架下的表现,发现使用 Pi 时比 OpenCode 高出约 10 分,排除了模型本身偏好的因素。
「编程与Agent」频道最新
- Pokee-Isaac 28B 演示 5 分钟内从创意到生成可玩游戏 — Kyrannio · 2026-08-27
- Demo:用自然语言配置 Coolifyio 部署应用 — tristanbob · 2026-08-27
- OpenRouter 免费模型 429 报错频发,10 美元验证值不值? — Clear-Presence6114 · 2026-08-27
- 实现 60fps 深度估计,推流端到端延迟目标 20ms — yacineMTB · 2026-08-27
- 在 code.storage 上试跑 Warp Factories,开发者称 DX 干净利落 — vikvang1 · 2026-08-27
- 实验双 Agent 协作:设定沉默角色以注入纠错视角 — sull · 2026-08-27