AMD 收购 Taalas:把整个模型烧进芯片,Llama 3.1 8B 跑出约 17000 tokens/s

acmoytoy · x · 2026-09-15

AMD 宣布收购多伦多公司 Taalas,后者 approach 与 GPU 完全不同:不从 HBM 加载权重,而是把模型权重与数据流直接蚀刻进晶体管,芯片本身就是模型。其首款芯片 HC1 在单一芯片上以约 17,000 tokens/s/用户 的速度运行 Llama 3.1 8B,号称打破了中心化 AI 实验室依赖的内存墙。转发者据此认为端侧、电池供电即可运行强大 AI,终端硬件的突破将瓦解对 AI 供给的集中控制叙事。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →