小众领域打标签仍是大模型软肋:聚类+二级 LLM 兜底流程实测
FanaHOVA · x · 2026-09-21
- 开发者在 Magic 卡牌分类任务上实测发现,大模型在 niche 领域创建标签时依然很笨,难以理解细微差别。
- 他提出一个理想流程:先用聚类 + LLM 生成第一波标签 → 用分类器处理并保留「Other」选项 → 再用第二次 LLM 处理「Other」以挖掘细微差异。
- 但实测发现第二轮 LLM 生成的标签非常脆弱(brittle),尚无完美方案。
「编程与Agent」频道最新
- ReCouPLe 用语言理由做几何约束,奖励模型分布偏移下精度提升1.5倍 — burny_tech · 2026-09-21
- Siri+Home Assistant+ChatGPT 语音:全自动囤货与备餐工作流 — athyuttamre · 2026-09-21
- 自托管 GLM-5.3 搭 DeepSeek Harness 实测缓存命中率 99.7% — burny_tech · 2026-09-21
- 同一个 Agent 成功率 97% 还是 39%?取决于你怎么定义成功 — hugobowne · 2026-09-21
- 独立开发者一次开源 4 个硬核系统项目,求工程师毒舌点评 — Accomplished_Row1433 · 2026-09-21
- 十个冷门 GitHub 仓库:WiFi 感知、多智能体交易、Agent 版本控制 — Shruti_0810 · 2026-09-21