新思路:基于信息产出量评估 LLM 创造力
dejavucoder · x · 2026-08-20
受香农关于创造力的文章启发,作者提出一种评估 LLM 的新思路:衡量模型在极少提示下能产生多少新信息。
「研究」频道最新
- LAWM-3D 负结果:多视角视频并不让潜动作学会 3D — andrew_n_carr · 2026-08-21
- AI 基准是有用还是坏掉了? — sanmikoyejo · 2026-08-21
- Google 发布 TIPS:具备空间感知的视觉语言模型,主打分割与深度估计 — _akhaliq · 2026-08-21
- LisanBench 排行:测 LLM 推理与规则遵循能力 — thisguyknowsai · 2026-08-21
- 学者激辩 AI 审稿:是用代码替代人类审稿人,还是让 AI 把关? — soumitrashukla9 · 2026-08-21
- 「OpenAI 探索最大化、Anthropic 利用最大化」:pass@k 训练策略之争 — scaling01 · 2026-08-21