新研究:推理时循环机制让冻结 LLM 困惑度降 23%
heghbalz · x · 2026-08-20
介绍了一种推理时循环机制,允许现成的冻结 LLM 表现出动态系统行为。通过将深层表示泄漏回浅层,在不触及模型权重的情况下,实现了显著性能提升:困惑度降低 23%,GSM8k 相对准确率提升 21%。
「研究」频道最新
- 花 250 美元复现 Mini Kimi-K3,性能超越 GPT-2 — OtherRaisin3426 · 2026-08-20
- llama.cpp 新 PR 用 AVX2 加速大批量 IQ 量化推理 — pmttyji · 2026-08-20
- 实测 Qwen 2.5 72B 参加 ACT 考试:阅读满分,综合 36 分 — on_line187 · 2026-08-20
- GitHub 收录 400+ AI/ML 精选书籍与资源 PDF — mdancho84 · 2026-08-20
- NVIDIA 收录 TriAttention,用三角函数压缩 KV 缓存 — 青稞AI · 2026-08-20
- NVIDIA 台北团队招聘具身智能等方向实习生 — CMHungSteven · 2026-08-20