Fable 5.1 与 Astra 在 Mensa 挪威测试双双满分
Chemical-Agency-3997 · reddit · 2026-09-24
Reddit 用户发帖称,Fable 5.1 与 Astra 两款模型均在 Mensa 挪威智商测试中取得满分成绩,并附截图。该测试常被社区用作横向比较模型推理能力的非正式基准,满分表现引发对这类基准是否已对前沿模型饱和的讨论。
「模型」频道最新
- 博主实测 Claude Opus 5.5:3D 建场景、电脑操作全面回勇 — ghumare64 · 2026-09-24
- HF 论文:校准应成为 LLM 评测的一等公民指标 — Mario Sanz-Guerrero · 2026-09-24
- 企业 AI 走向更小更窄模型,价值反而更高 — DavidLinthicum · 2026-09-24
- 蚂蚁开源 AntSpeaker/MECT:9.57M 小模型声纹验证追平 5.87 亿参数模型 — aigclink · 2026-09-24
- Reddit 用户:Claude 模型做 SVG 动画竟自带「有人乐在其中」的品味 — Acclynn · 2026-09-24
- Bug Hunt Bench:105 个真实植入 bug 横评前沿编码模型,成本差 200 倍 — PawelHuryn · 2026-09-24