零真实数据训练出新研究:两个模型互搏也能学出通用模式
mark_k · x · 2026-09-25
一项新论文展示了完全不用真实世界数据的训练实验:两个模型从零开始,一个编写小程序生成字节序列,另一个学习预测这些序列,前者随后不断生成能促使后者进步的序列。
仅在这些自生成序列上训练后,随着算力增加,学习模型在预测真实文本、图像、语音和 DNA 上的表现反而变好了。作者认为这是早期概念验证,但结果颇为惊人:不接触任何自然样本,也能涌现出有用的通用模式。
「研究」频道最新
- ICLR 摘要注册达 6 万篇,研究者 lament LLM 让论文写作同质化 — mariyaivasileva · 2026-09-26
- Interspeech 2026 悉尼开幕在即,CMU 团队携 2 教程 19 篇论文参会 — shinjiw_at_cmu · 2026-09-26
- 开发者撰文:RAG 无法替代一个好模型 — galratner · 2026-09-26
- 可组合 AI 之争:现有编程语言够用吗?关键在语法加运行时 — sh_reya · 2026-09-26
- 数据科学最重要的 25 个数学定义清单发布 — MIT_CSAIL · 2026-09-26
- NVIDIA 开源 MONAI Physio:从 3D 医学影像生成心肺数字孪生 — Paimaamu · 2026-09-25