TEAS 基准:按数据集自然长度测推理,报告成本与能耗
PontiEdoardo · x · 2026-09-01
Edoardo Ponti 介绍 TEAS 评测方法:不同于固定长度测量的失真,TEAS 按每个数据集的自然长度处理 chunked prefill、拒答以及 prefill 与 decode 混合的步骤,从而捕捉真实的稀疏激活与带宽利用率。指标覆盖成本、准确率、性能(用户体验与系统输出)以及能耗估计,其中准确率用于确认运行有效性并揭示可用的权衡。
所属事件:英国三校开源 TEAS 基准:跨 9 种加速器测 AI 推理成本与能耗(3 条相关)→
「Infra」频道最新
- LITE 推 VCSEL 用于 AI 扩展互连,产品延后 — zephyr_z9 · 2026-09-01
- 小红书推专用引擎GR-Inference,Beam搜索吞吐翻倍 — 小红书技术REDtech · 2026-09-01
- antirez 演示 DeepSeek v4 Flash 视觉版在 M5 Max 上本地快速运行 — antirez · 2026-09-01
- 英伟达财报:避免算力垄断与每千瓦时美元价值 — Stratechery · 2026-09-01
- Sats4AI 接入闪电网络,提供多模态 AI 付费工具 — modelcontextprotocol · 2026-09-01
- TEAS 基准:9 种加速器跑 6 类真实 Agent 负载 — PontiEdoardo · 2026-09-01