Gary Marcus 呼吁深究模型能力突破背后的工程细节
GaryMarcus · x · 2026-08-02
针对近期令人瞩目的 AI 测试结果,Gary Marcus 转发并赞同了业内人士的深度质疑:比起单纯的跑分成绩,当前更应关注实现这些突破的具体工程过程。例如,这究竟是单纯因为模型基础能力的提升,还是得益于更精细的测试流程与后训练方法?业界亟需更多关于测试脚手架和后训练细节的透明度。
所属事件:OpenAI数学突破遭Gary Marcus等质疑炒作(38 条相关)→
「模型」频道最新
- GPT-6 Astra 通关 Factorio 太空时代,游戏内耗时超 165 小时 — aran_nayebi · 2026-09-18
- Qwen3.8-Omni-Flash 发布:多人会议识别错误率降至 3%,API 降价 98% — karminski3 · 2026-09-18
- 内部人士:Gemini 3.8 live 部分基准已胜过 gpt-live-1 — bosmeny · 2026-09-18
- 105 个植入 bug 实测:Pareto 以 4.81 美元成本逼近顶级模型 — PawelHuryn · 2026-09-18
- Jason Wei 演讲:智能正商品化,自适应计算是关键转折 — dotey · 2026-09-18
- GPT-6-Astra 三小时通关《过山车大亨2》,对手花 5 倍 token 仍未达标 — scaling01 · 2026-09-18