DwarfStar 加入 GPT5.6-Sol 版 laguna-s2.1 实现,M5 Max 跑到 50 t/s
antirez · x · 2026-07-23
DwarfStar 的 laguna-s2.1 分支接入 GPT5.6-Sol 实现
Antirez 说,DwarfStar 的 laguna-s2.1 分支里已经加入了一个由 GPT5.6-Sol 编写的 Laguna S2.1 实现,而且他还对一些非平凡任务做了人工 sanity 测试。
他同时给出了在 M5 Max 上的速度数据:
- 生成 50 tokens/s
- prefill 500 tokens/s
- 目前 只支持 Metal
帖子还提到,GPT5.6 Sol 还能帮你写其他后端,说明这里不只是模型讨论,而是把模型真正用进了代码实现流程里。
所属事件:GPT5.6 几乎独立写出 Laguna S2.1 推理实现(3 条相关)→
「编程与Agent」频道最新
- 模型之外才是关键:一文拆解 RAG 到多智能体的六大 AI 架构 — goyalshaliniuk · 2026-09-11
- 零基础开发者自建分层记忆架构,仅 20k token 记住一年对话 — matteoianni · 2026-09-11
- Warp 六个非工程团队全用 Linear 和 Claude Code 工程化运作 — mon__lim · 2026-09-11
- 九年后端老兵:AI 代码不比人写的差,变糟的只是速率 — Sweaty-Landscape-561 · 2026-09-11
- 实测质疑 RTK 省 token 说法:成本基准显示并不成立 — michalwarda · 2026-09-11
- 从聊天到 Agent,推理延迟正在成为生产级瓶颈 — Euphoric_Sea632 · 2026-09-11