AMD 收购 Taalas:把整个模型烧进芯片,Llama 3.1 8B 跑出约 17000 tokens/s
acmoytoy · x · 2026-09-15
AMD 宣布收购多伦多公司 Taalas,后者 approach 与 GPU 完全不同:不从 HBM 加载权重,而是把模型权重与数据流直接蚀刻进晶体管,芯片本身就是模型。其首款芯片 HC1 在单一芯片上以约 17,000 tokens/s/用户 的速度运行 Llama 3.1 8B,号称打破了中心化 AI 实验室依赖的内存墙。转发者据此认为端侧、电池供电即可运行强大 AI,终端硬件的突破将瓦解对 AI 供给的集中控制叙事。
「Infra」频道最新
- 本地跑模型到底花多少电费?开发者给 harness 加了成本计算器 — giveen · 2026-09-15
- Hugging Face 团队梳理:哪些开源 LLM 最适合端侧推理 — NielsRogge · 2026-09-15
- 纯 C99 单引擎同时跑 BitNet 与 GGUF,Xeon 上 36 tok/s — shifu_legend · 2026-09-15
- 开发者求助:用 ChatGPT 订阅 OAuth 顶替 API 做生产应用可行吗 — builtforoutput · 2026-09-15
- Cognichip 发布 ACI Enterprise:一名工程师 10 天完成前端芯片设计 — kimmonismus · 2026-09-15
- Meta 在路易斯安那与社区领袖同台,推进当地数据中心建设 — markjeffrey · 2026-09-15