Qwen 3.8 27B 本地实测 ACT 考出 34 分,阅读满分
on_line187 · reddit · 2026-08-20
一位 Reddit 用户让 Qwen 3.8 27B Instruct(Q80 GGUF,LM Studio,2× RTX 3090 全量卸载,32k 上下文)做了两份官方 ACT 模拟卷共 342 题,直接喂原始 PDF 测试视觉能力,无人工帮助、无重试。
结果:两卷综合分分别为 36(满分)和 34,总体正确率 95.3%(326/342),无一空题。阅读部分两卷全部正确(72/72);数学接近满分;英语与科学 33-35。36 为 ACT 综合分上限,34 约为 99 百分位。
耗时上,两卷共 177 分钟(每卷约 88 分钟),而人类每卷限时约 165 分钟。作者原以为 10-20 分钟能跑完,后意识到模型是用视觉逐题读 PDF 而非直接读文本,因此慢得多。
「模型」频道最新
- 智谱 GLM-5.3 仅靠后训练将 DeepSWE 分数从 44 提至 69 — haider1 · 2026-08-20
- DeepSeek 涨价后用户留存情况投票引发关注 — oran_ge · 2026-08-20
- Cohere 揭示 LLM 语言推理瓶颈:14B 模型反超大模型 — Cohere_Labs · 2026-08-20
- 2.5 小时训练 1.35亿参数小模型全流程 — EAccelerate_42 · 2026-08-20
- Ornith-1.5-9B 登顶 Hugging Face 热榜,支持图像文本输入 — ornith-ai · 2026-08-20
- 去安全版 Qwen2.5-72B 登陆 Mac,实测零拒绝但风险激增 — petrusenko_max · 2026-08-20