Cohere 举办 IOL-AI 2026,挑战大模型语言学推理极限
Cohere_Labs · x · 2026-07-25
Cohere 实验室发起的 IOL-AI 2026 挑战赛即将截止报名。该比赛旨在测试开源模型在从未见过的语言学问题上的推理能力。
比赛要求参赛者让模型学习并推理一种全新的、未公开的语言规则。Cohere 表示,此举是为了验证模型到底是真正具备逻辑推理能力,还是仅仅在死记硬背。表现最优的方案将由国际语言学奥林匹克(IOL)评委进行人工评估。
所属事件:Cohere 发起 IOL-AI 2026 挑战赛(2 条相关)→
「研究」频道最新
- 商业化 AI 基准分差很小,可能只是噪声 — PerformanceRound7913 · 2026-07-25
- 发布博客预告:FrontierCode 智能体编码基准打平 — hardmaru · 2026-07-25
- 蒸馏后的小模型可能因更强泛化反超老师 — peterjliu · 2026-07-25
- Opus 5 在九项生物基准登顶,但仍有几项分析任务落后 — kenbwork · 2026-07-25
- ARC-AGI 新解读:符号 AI 正在回潮 — typewriters · 2026-07-25
- 媒体机构生成式AI使用研究招募记者访谈 — QVeraLiao · 2026-07-25