曝 Claude Sonnet 5.5 实测 120-130tps,跑分全绿但未证实

julianharris · x · 2026-10-01

开发者 julianharris 发帖称「Sonnet 5.5」在他自建的 spec-driven 长文基准上持续跑出 120-130 tokens/s,且目前所有任务 100% 通过。他的基准做法是让 LLM 端到端构建完整应用,再用隐藏的 holdout 测试集检验(相当于对模型「严刑拷打」)。

注意:该模型尚未官方发布,「Sonnet 5.5」的命名与成绩均属未证实爆料;帖子附带的 GitHub 链接是 awesome-local-ai 仓库,收录了在 24GB/64GB 等不同硬件上用 llama.cpp、sglang、mtplx 运行 Qwen 等本地模型的配置脚本。

若属实,吞吐与通过率都是明显跃升;建议等官方发布与独立复测后再下结论。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →