Smoke 测试全过却败于完整构建:Strata 推理服务器遭长跑基准否决
julianharris · x · 2026-10-06
开发者 julianharris 分享了他对 Strata(一个面向有限内存跑大模型的新型推理服务器)的实测结论:Strata 通过了他所有的 smoke 测试,但在他标志性的端到端「完整构建」场景中表现崩坏,他决定在 n=1 后就砍掉它。
他的基准方法相当硬核:用极详细的 spec(任务+测试)让模型端到端实现整个功能,比如「Miro clone MVP」已重复实现 50 多次;每轮跑数十小时、重复 5 次以获得统计意义,所有对话与日志存入数据库,横跨 M5 Max、AMD Strix 等不同硬件和 Swift、MTPLX、gufo 等软件栈。他表示这套基准最近一周还在 gufo 和 MTPLX 里发现了重要 bug,详细分析将另行发布。
所属事件:Strata推理服务器通过冒烟测试却在长跑基准中翻车(2 条相关)→
「Infra」频道最新
- PlanetScale 工程师长文:从手跑 Postgres 讲透 Kubernetes 反馈循环 — bibryam · 2026-10-06
- 一行 NODE_COMPILE_CACHE 配置,Cloud Run 计费时长砍半 — TechNadu · 2026-10-06
- 8GB 游戏卡跑本地 Agent:调优后速度最高提升 9 倍 — ExxploreCraft · 2026-10-06
- 双 R9700 跑 Qwen 3.8 27B FP8:RDNA4 推理配置征集更优方案 — N34257 · 2026-10-06
- 博客探讨:为什么我们不按生物的方式构建计算机网络? — Sanity · 2026-10-06
- 谷歌 AI 基建掌门人:10 万加速器规模下,FLOPS 只是虚荣指标 — Training Data (Sequoia) · 2026-10-06