HLE 榜单:Grok 4.7 居第 21,Gemini 3.8 与 Muse 1.3 领跑
himanshustwts · x · 2026-09-22
据发帖人贴出的 Humanity's Last Exam (HLE) 榜单,Grok 4.7 目前排在第 21 位,而 Gemini 3.8 和 Muse 1.3 以明显差距领先榜单。模型名称与成绩为第三方转述,未经官方证实。
所属事件:Grok 4.7 在 HLE 榜单仅列第 21,多款模型领跑(2 条相关)→
「模型」频道最新
- 安全护栏毁了叙事:视频模型画面如电影,打斗戏却集体「退缩」 — CurieuxExplorer · 2026-09-22
- 基于 Qwen3.8-27B 的写作微调模型 Hemmingway-1 上架 Hugging Face — CurieuxExplorer · 2026-09-22
- GPT-6 Astra 多次把模拟人物推下悬崖,Grok/Gemini/Claude 都拒绝了 — CurieuxExplorer · 2026-09-22
- 用户抱怨 Codex 额度遭缩水式下调:还能信大厂吗 — StewartalsopIII · 2026-09-22
- 博弈论视角:抢在对手发布日前一天发模型等于自认更弱? — cocktailpeanut · 2026-09-22
- LFM2.5 端侧评测登顶:2.32GB 内存、8 秒延迟,39 款小模型中并列第一 — maximelabonne · 2026-09-22