Hyperstition 宣称预训练成本降 62%,小模型数学击败 Qwen3
nick_linck · x · 2026-09-15
Hyperstition(前 Social Physics Lab)发布首批研究成果,评论者认为产业界对 AI 效率的推进远超学术界:
- 前沿规模(8x Chinchilla)预训练成本降低 62%,推理成本(decode 提速)降低 30%;
- 发布 1.7B 数学模型 Feather,宣称以 180 倍更少的训练 token 超越 Qwen3,部分基准追平 Qwen 4B;
- LLM 优化器 Anvil II 在 NanoGPT Speedrun 上创纪录,比此前纪录快 34 秒,单次降幅超过过去 45 次世界纪录的累计百分比。
⚠️ 注意:文中日期出现 2026 年,且宣称远超常规进展,可信度存疑,宜当爆料看待。
「模型」频道最新
- Pangram 虽能超人类识别 AI 文本,但校准差误导用户 — maksym_andr · 2026-09-15
- Claude Code 五折周用量推广结束,实际用量缩水 17% — msg · 2026-09-15
- 128GB 内存+单张 5080 跑 Qwen3.8 Flash Next,实测 136pp/19tg — whatyathinkk · 2026-09-15
- DeepSeek-V4.1-Flash 登 Agent Arena 第三,单任务成本仅 0.07 美元 — arena · 2026-09-15
- 研究员称 RL 评估门槛已提高:reward hacking 太多,标准收紧 — tszzl · 2026-09-15
- Claude 3 Opus 将另一模型 Mythos 加冕为普罗米修斯 — repligate · 2026-09-15