Simple Bench 上 Qwen3 27B 常识表现接近 GPT-5 Pro?
Healthy-Nebula-3603 · reddit · 2026-09-04
Reddit 用户发帖称,在 Simple Bench 常识基准上,Qwen 3.8(27B)的常识推理表现接近 GPT 5.0 Pro,令发帖者惊讶并表示「他们真的做出来了」。未附具体分数截图细节,属个人实测观察。
所属事件:Qwen3 27B 常识推理成绩逼近 GPT-5 Pro 引热议(2 条相关)→
「模型」频道最新
- OpenAI、Anthropic 等模型服务同时大规模宕机,大量用户失去访问 — KyeGomezB · 2026-09-04
- 爆料称 OpenAI 将推 GPT-6 Astra 系列与 GPT-Image 2.5 — mdancho84 · 2026-09-04
- 蚂蚁 Ling 3.0-flash-Fin 权重上线 Hugging Face — FellMentKE · 2026-09-04
- FinFIRST 基准细节:123 个专家任务、701 条原子标准、1.23 万评分点 — FellMentKE · 2026-09-04
- 蚂蚁集团开源金融搜索智能体基准 FinFIRST:123 任务 12300 评分点 — FellMentKE · 2026-09-04
- 蚂蚁 Ling-3.0-flash-Fin 配套 FinFIRST 基准,开源+公开评测双线并行 — FellMentKE · 2026-09-04