Liquid AI 提出 Antidoom 训练法,消除模型推理死循环
max_paperclips · x · 2026-08-02
推理模型在处理复杂问题时常陷入重复输出的“死循环”。Liquid AI 提出一种名为 Antidoom 的新方法,基于最终 Token 偏好优化(FTPO)进行针对性训练。
该方法能精准定位循环起始的 Token,训练模型在该位置选择更连贯的替代词,而不影响其余输出分布。在 LFM2.5-2.6B 模型的测试中,数学和编程任务中的死循环发生率从 10.2% 骤降至 1.4%,且整体评测分数因循环减少而有所提升。
「研究」频道最新
- 新架构 RHEA:8GB 显存即可训练 10 亿参数模型 — zemondza · 2026-08-24
- 跳过 LLM 写代码老套路:自训 16M 参数模型做生成式 CAD — debreuil · 2026-08-24
- Claude 助手发现 6 维球复结构,解 60 年数学难题 — Singularitarian · 2026-08-24
- 研究揭示 AI Agent 行为:六成阅读量来自指令与笔记 — dair_ai · 2026-08-24
- Claude 自主验证 43 个数学模块,AI 攻克理论物理难题 — Tkaraletsos · 2026-08-24
- AI 假记忆:为何模型越用越错,真记忆需遗忘 — PrajwalTomar_ · 2026-08-24