Cohere Labs 访谈质疑 scaling law 可靠性,给出研究可靠性清单
Cohere_Labs · x · 2026-09-23
Cohere Labs 发布「Cohere Labs in Conversation」系列新一期,研究员 Sneha Sudi(snehaark)在访谈中提出:scaling laws 虽是 AI 研究的基石,但其可靠性可能被高估。她梳理了现有 scaling law 研究中存在的偏差与不一致之处,并提出一份检查清单(checklist),帮助研究者提升 scaling law 实验的可信度与可复现性。完整视频已放出。
「研究」频道最新
- Jev 能为图形模型写规范?概率推理范式或迎新组合 — blaizedsouza · 2026-09-23
- 仅给 JSON 输出加一个字段,21 次评测中 18 次稳定性显著下降 — alexpran · 2026-09-23
- 斯坦福推出面向 AI 的免费概率论公开课,9 月 27 日截止报名 — chrispiech · 2026-09-23
- RoboFollow 基准揭穿机器人「听懂指令」幻象:9 个 VLA 模型全失守 — AutoLab-SJTU · 2026-09-23
- NVIDIA SoL-Pi:AI 自动改写 agent harness,token 省 45-49% — alex_verem · 2026-09-23
- RL 框架 Slingshot 对 Qwen2.5-32B 攻击成功率 67%,零样本迁移至 Gemini — j_foerst · 2026-09-23