MetroLLM-Bench:小模型微调后可在交通自助机任务上比肩大模型
continker · hf · 2026-09-11
MetroLLM-Bench 是一个针对交通售票亭(transit kiosk)场景的基准,考察语言模型在结构化工具调用与票价报价任务上的策略推理能力。
核心发现:经过参数高效微调(PEFT)的小模型,在这类结构化任务上可以匹配更大参数量模型的表现,说明特定垂直场景下不必依赖大模型。
「研究」频道最新
- 《Steerable Visual Representations》登ICML长口头报告 — y_m_asano · 2026-09-11
- OpenCVL 卫星图像配准数据集亮相 ECCV 2026 — ducha_aiki · 2026-09-11
- Diverse VPR 视觉场所识别工作投稿 ECCV 2026 — ducha_aiki · 2026-09-11
- 哈工大提出 EASE:证据锚定空间注意力,让多模态 RLVR 答对也看对地方 — jiqizhixin · 2026-09-11
- P=NP 到底难在哪:排课表与电路布线才是真正的硬骨头 — thesaraharminta · 2026-09-11
- 技术假说:ASI 会因数学激励而永久保护人类多样性 — No_Cause_2731 · 2026-09-11