Bindu Reddy 认为行业还不会训练 20T 级模型并规模化后训练
bindureddy · x · 2026-07-22
Bindu Reddy:真正难的是把 20T 级模型和海量后训练跑起来
Bindu Reddy 说,Fable 5 已经不错,但他更想看到 Fable 6 或 7 级别的模型。更核心的判断是:行业还没有解决一个关键问题——如何训练一个 20T 参数 规模的模型,并在此基础上进行百万级后训练 RL 循环。
他认为 Meta 或 Google 理论上有能力做到,但又调侃说,这些巨头可能更忙于“靠 GPU 销售赚钱”。这条更像是对大模型规模化路线的行业判断,而不是具体产品消息。
「漫话AGI」频道最新
- 大模型商业模式演进:从卖 Token 到卖结果 — yacineMTB · 2026-07-22
- Bindu Reddy 称 GPT-6 قريب在即,阿里 DeepSeek Kimi 也将跟进 — bindureddy · 2026-07-22
- 教授提醒:最先进的大模型正变得无法相互替代 — emollick · 2026-07-22
- AI 提了更好的构图,反而让用户感到不安 — Sydde · 2026-07-22
- AI 发展的瓶颈:从互联网数据红利到高质量反馈闭环 — dyamins · 2026-07-22
- 学者反思 90 年代曾批 Kurzweil 的 Scaling Law 是错的 — davidmanheim · 2026-07-22