新架构 RHEA:8GB 显存可训练 10 亿参数模型

一位独立开发者提出了名为 RHEA 的新型神经网络架构。它不依赖标准 Transformer 层堆叠,而是基于事件驱动响应机制运行,并结合特定优化技术,使 10 亿参数规模的模型能够在配备 8GB 显存的 RTX 4070 上训练,甚至可在 RTX 5070 笔记本上完成训练,大幅降低了大模型训练的硬件门槛。

2026-08-24 ~ 2026-08-24 · 2 条相关