斯坦福提出 Priced Guidance:量化 LLM 能否预测未发表研究
stanfordnlp · x · 2026-10-07
Percy Liang 转发其团队新工作:直接采样估计 LLM 能否生成/预测 cutoff 之后某篇新论文,在统计上不可行(尾概率天文级小)。
核心思路是「定价引导」(Priced Guidance):让模型 Astra 与一个持有论文的 guide LLM 对话,以「20 个问题」方式恢复论文想法 X,并按每条提示的 surprisal 精确计费,从而给出 P(LLM 预测未来论文) 的下界——传输的信息比特数可被严格核算。作者也将其定位为一种前沿模型的新评测方法。
所属事件:斯坦福提出 Priced Guidance 量化 LLM 创新能力(3 条相关)→
「模型」频道最新
- 700亿参数数学模型Bel引争论:合成数据还是规模红利 — teortaxesTex · 2026-10-07
- Fable 自评新发布:相当于约 5 个「OpenAI 纳维-斯托克斯」级成果 — willdepue · 2026-10-07
- Reddit 用户发布去审查 27B 红队安全模型,自称零拒绝 — Least_Dog_8556 · 2026-10-07
- OpenAI 研究员惊讶:AI 实验室数学新成果至今没查出硬伤 — willdepue · 2026-10-07
- OpenAI 模型在 ARC 类谜题上输给 Meta 的 Muse — BLUECOW009 · 2026-10-07
- Inception 免费推出 Mercury Decide:每秒 14 次结构化决策,对标 Jev — StefanoErmon · 2026-10-07