质疑 OpenAI 的 AGI 数字:来自评测框架而非模型本身
mcraddock · x · 2026-09-10
mcraddock 指出,OpenAI 对外宣称的 AGI 相关数字实际来自评测框架的产物,而非模型本身的能力。这一说法若成立,意味着评测口径可能夸大了模型的真实水平。属个人质疑,未经证实。
「模型」频道最新
- InclusionAI 免费开放医疗模型 Ling 3.0 Flash Sante,262K 上下文 — FellMentKE · 2026-09-10
- DeepSeek V4.1 Flash 多模态 OCR 实测:速度 260 tok/s,性价比突出 — solyarisoftware · 2026-09-10
- 医疗 AI 模型 Sante 发布:基于 Ling-3.0-flash,强调安全与循证 — FellMentKE · 2026-09-10
- 医疗 AI 模型 Sante 发布:基于 Ling-3.0-flash,强调安全与循证 — FellMentKE · 2026-09-10
- 医疗 AI 模型 Sante 发布:基于 Ling-3.0-flash,强调安全与循证 — FellMentKE · 2026-09-10
- Yoav Goldberg 算账:88 万 GPU 小时跑出的数学成果,两人几百小时提示词也能搞定 — yoavgo · 2026-09-10