Qwen3.8-Max 法律研究评测不到三月飙升至全球第四
Alibaba_Qwen · x · 2026-08-12
据 ValsAI 评测数据显示,阿里 Qwen3.8-Max 模型在法律研究基准测试中取得显著进步。该模型在不到三个月的时间内成绩近乎翻倍,排名从全球第 22 名跃升至第 4 名。
「模型」频道最新
- 小米开源多语言翻译模型,超越主流闭源基线 — xiaomi-research · 2026-08-12
- DeepSeek前缀缓存优化实战:单次Agent任务成本降至0.005美元 — BodybuilderLost328 · 2026-08-12
- 端侧MoE模型实测:NVIDIA Lightning比Qwen快2.5倍 — parepeg · 2026-08-12
- 社区疯狂微调 MiniMax H3,开发者呼吁官方推出 Turbo 版 — cocktailpeanut · 2026-08-12
- 新基准 MLS-Bench 揭示:前沿大模型仍不具备独立科研创新能力 — 新智元 · 2026-08-12
- 曝GPT-5.6 STEM能力超Fable 5,下代模型或重拾写作质感 — haider1 · 2026-08-12