Lithos 团队:别拿 benchmark 当选型铁证,先定义自身指标
JiaZhihao · x · 2026-09-16
Lithos AI 团队发文提醒:把 AI benchmark 当作模型、推理服务或 agent 优劣的绝对证明是错误做法。推理引擎用户真正关心的是端到端延迟、每用户 tokens/s、首 token 时间(TTFT)与总吞吐和单位 token 成本;其 Kimi 3 推理在 Artificial Analysis 的结果只能覆盖部分指标,且无法 1:1 匹配用户具体负载。建议工程团队在认真看 benchmark 前,先根据实际用例和流量确定关键指标,并在真实生产条件(含运维约束)下评估现有基准方法。
「Infra」频道最新
- 亚马逊 SVP DeSantis:模型与芯片路线图需提前数年互相预判 — dawnsongtweets · 2026-09-16
- Perplexity 自研 CobbleDB 替代 DynamoDB,p99 延迟从 123ms 降至 24.2ms — perplexity_ai · 2026-09-16
- 替代 DynamoDB 后,CobbleDB 批读中位延迟 31.4ms 降至 5.6ms,省 20% 成本 — perplexity_ai · 2026-09-16
- CobbleDB 写入链路:Pillar/Lorry/CobbleDB 三分离,副本可各自按序消费更新 — perplexity_ai · 2026-09-16
- 为优化读路径重写更新投递:CobbleDB 状态/投递/服务三组件分离 — perplexity_ai · 2026-09-16
- CobbleDB 读取架构:按分区并行 RocksDB MultiGet,同区副本优先路由 — perplexity_ai · 2026-09-16