Strata推理服务器通过冒烟测试却在长跑基准中翻车

开发者 julianharris 对主打有限内存运行大模型的新型推理服务器 Strata 进行了长期实测。他使用极详细规格让模型完整实现功能(含任务与测试)的端到端基准,单次运行长达数十小时,每组跑 5 次取统计数据。结果显示 Strata 虽通过了全部冒烟测试,却在标志性的完整构建任务(如 Miro clone MVP)上表现不佳,最终被该长跑基准否决。

2026-10-06 ~ 2026-10-06 · 2 条相关