Signal65 评测:AMD MI355X 对阵 B200,p99 延迟低 42%、每美元 token 最高 2.15 倍
ryanshrout · x · 2026-09-30
Signal65 发布了一份三层次推理基础设施评测,对比 AMD Instinct MI355X 与 NVIDIA HGX B200,在 GPT-OSS-120B、Qwen3-Next-80B、Kimi-K2.6 三个生产级模型上测试。
关键结果:
- RAG 测试中 MI355X 的 p99 延迟低约 42%,可承载约 2 倍并发用户才触及 SLA 上限
- 金融分析场景每小时多处理 1.3 倍文档,单文档成本低 53%
- 按美元算 token 产出最高 2.15 倍——包括 B200 在原始吞吐上领先的情形
- 同等交互用户规模下成本低 39.6%
评测强调仅看峰值吞吐或孤立成本都不足以反映企业真实业务结果,应结合硬件性能、运营经济性与工作负载影响综合判断。
「Infra」频道最新
- 0.6B 小模型替换规则清洗栈,预训练 DCLM 分数提升 4.7% — XiongChenyan · 2026-09-30
- Anthropic 用 Claude 两周把 claude.ai 提速 3 倍,合并三千次改动零事故 — trq212 · 2026-09-30
- 在 AMD RX9070 上跑通开源音乐模型 YuE2,Linux 全流程安装记录 — ATA-3D · 2026-09-30
- 论文 LLM-42 登 SOSP 2026:验证式投机让 LLM 推理确定性几乎零开销 — tianyin_xu · 2026-09-30
- 印尼 AI 路线之争:有数据中心不等于有控制权 — AryHHAry · 2026-09-30
- 特斯拉获300亿美元授信,加码AI基础设施、Robotaxi与芯片制造 — Polymarket · 2026-09-30