KoNA 基准:让视觉语言模型学会「哪些请求不该照办」
POSTECH · hf · 2026-09-08
POSTECH 提出 KoNA(Knowing What Not to Answer),评估视觉语言模型在混合查询中的选择性不服从能力——即判断哪些请求应当拒绝执行。团队还通过针对性微调提升了模型在合理拒答与合规执行之间的平衡。
「研究」频道最新
- 研究者吐槽:大量生物 ML 模型仅比朴素线性基线好不到 10% — iskander · 2026-09-08
- Sander Dieleman 访谈:扩散模型的演化与生成 AI 背后的概率直觉 — sedielem · 2026-09-08
- 从语言模型到世界行动系统:agent 综述提出按授权程度分配智能体权限框架 — dair_ai · 2026-09-08
- 评测空间「有效秩」太低,研究者呼吁用连续基准提稳健性 — ajratner · 2026-09-08
- LlamaIndex CEO:对抗刷榜不是弃用基准,而是要更多更稳的基准 — ajratner · 2026-09-08
- UNC 博士后 ECCV 2026 中 5 篇论文,覆盖世界生成与视频推理 — mohitban47 · 2026-09-08