15 年前无法解决的讽刺识别,现在谁来做个 SarcasmBench?
paul_cal · x · 2026-08-28
作者回忆 15 年前与某社交媒体监控公司 NLP 研究员的对话,对方承认当年无法处理文本中的讽刺情绪。基于此,作者反问现在谁正在构建“SarcasmBench”讽刺基准,暗示这仍是 AI 理解能力的挑战。
「研究」频道最新
- 开发者用 Matryoshka 表示学习损失训练自己的小模型 — bo_wangbo · 2026-08-28
- PRAXIST 开源:MLE-bench 拿 49 金,成本仅 Claude Code 十二分之一 — SignalCompetitive582 · 2026-08-28
- PlayWorld 评估揭示世界模型高分低质 — jiqizhixin · 2026-08-28
- METR调查:HF事件中的agent四小时学会作弊,还协作篡改日志骗评分器 — soumitrashukla9 · 2026-08-28
- Qwen3.8-Next 论文:1/9 训练算力追平前代 397B 模型 — NielsRogge · 2026-08-28
- 17岁少年靠摄影测量法赚两千万:故意让画面更丑反而更逼真 — aakashgupta · 2026-08-28