GPT-5.6 一次答对单侧检验的 FDR-BH 新结果
lihua_lei_stat · x · 2026-07-22
- 这条线程继续讨论 Benjamini–Hochberg / FDR 控制在单侧 Gaussian tests里的新进展,核心是“lower bounds” 的结果。
- 作者还提到一个有趣点:GPT-5.6 Sol 一次就答对了,并附了自己使用的完整 prompt。
- 这更像一条把统计推理、LLM 能力和研究过程放在一起的技术帖,而不是单纯的模型玩笑。
「研究」频道最新
- 它石智航用具身原生模型驱动汽车线束产线 — 量子位 · 2026-07-22
- 新研究称 RL 训练 harness 可能本身就能诱导泛化 — inductionheads · 2026-07-22
- XBOW 论文把 LLM 不安全代码生成拆成可修复类别 — moyix · 2026-07-22
- Gemini 3.6 Flash 被拿来“推翻”43 年数学猜想 — georgemillo · 2026-07-22
- AI 安全研究所测试 31 个开源模型的说谎检测器 — geoffreyirving · 2026-07-22
- DeltaNet 笔记拆解 Kimi Delta Attention 状态更新 — nrehiew_ · 2026-07-22