当模型能力趋同,大模型工作只剩两件事:数据和基础设施
saurabh_shah2 · x · 2026-09-16
一条简短但反映行业共识的观察:随着模型能力问题基本被解决,语言模型方向的工作只剩下两类——数据和基础设施。隐含判断是模型架构层面的竞争空间已经收窄,未来的差异化来自数据质量与训练/推理基础设施。属一句话观点帖,信息量有限。
「Infra」频道最新
- RX 7900 XTX 本地跑 GPT-OSS-20B 比 R9700 快 30% — glenbeer · 2026-09-16
- 实测爆料:Rubin NVL72 每 MW 吞吐已达 Blackwell 7 倍,官方只敢讲 3 倍 — sudoraohacker · 2026-09-16
- 马斯克解释为何必须建 Terafab:地缘风险加产能天花板 — elonmusk · 2026-09-16
- Google DeepMind 长文详解分片矩阵乘法:万卡 TPU 训练的通信理论 — zacharynado · 2026-09-16
- RX 9070 跑音乐模型 YuE2 仅约 7 token/s,VRAM 大量闲置引困惑 — Prestigious-Kick7291 · 2026-09-16
- 对话 StartLux CTO:27B 本地模型逼近 DeepSeek 大模型,主攻本地 RSI — 机器之心 · 2026-09-16