泄露称 Gemini 3 用 TPU MoE 训练,电脑操作和数学都很强

k_kohlbrenner · x · 2026-07-24

这条帖转述了一则关于 Gemini 3 的泄露信息:据称它在正式发布前数小时就已流出,而且表现“非常强”。

被引用的内容里提到,Google 似乎是 从零开始用 TPU 训练,采用 MoE 架构,输入上下文达到 100 万、输出长度 64k,因此可能更容易把成本压下来。

泄露内容还声称它在几个方向上很强:

后面的回复主要是在质疑爆料者的预测记录,但核心信息仍然是这次 Gemini 3 的泄露模型表现。

原文链接 →