质疑 OBLIQ 任务是否导致模型过拟合特定相似度
antoine_chaffin · x · 2026-08-23
作者针对 OBLIQ 任务提出质疑,认为当前的模型训练可能仅仅是针对这些特定任务“烤制”进了一种特定的相似度概念,而非真正掌握了解决此类任务的通用提示机制。作者担心这容易通过合成数据实现,但未必能泛化到分布外(OOD)任务,并对比了 Late Interaction 与 Promptriever 等方案。
「模型」频道最新
- 怀念 GPT-4.5 级情感智能,期待 Astra 复刻 — haider1 · 2026-08-23
- 点评 ox 模型:像博士级勤务员的谨慎子智能体 — teortaxesTex · 2026-08-23
- Qwen3.8-27B 推出 GGUF 格式,集成推测解码加速 — z-lab · 2026-08-23
- MiniMax H3 提示词服从度太高,导致视频缺乏生动细节 — DifficultAd5938 · 2026-08-23
- 普林斯顿 i1 模型:全开源文生图方案与 300 组实验 — 机器之心 · 2026-08-23
- AI 生成文本现“费布利什”怪象:否定词错乱与宾主倒装 — alexisgallagher · 2026-08-23