Qwen3.8-27B 夺 Harvey 法律 Agent 榜首
Alibaba_Qwen · x · 2026-08-19
Qwen3.8-27B 在 Harvey 的 Legal Agent 基准测试中排名第一,与 Fable 5 同分(11.3分),超越了 Kimi K3、Qwen 3.8 Max 和 DeepSeek V4。该模型强调其具备处理专业任务的能力,且体积小到可在本地运行,适合集成到日常工作流中。
「编程与Agent」频道最新
- ASC CLI 新版增加 Apple 开发者状态解析 — rudrank · 2026-08-19
- 发现可抓取小红书和公众号内容的 API,Agent 实时数据获取新解 — vista8 · 2026-08-19
- 实测对比:Fable 准确率更高,K3 性能惊人 — abacaj · 2026-08-19
- LLM 擅长逆向内存补丁,却像个 5 岁小孩点按钮 — Vjeux · 2026-08-19
- 用 Kimi K3 打造自主竞品分析 Agent — VibeMarketer_ · 2026-08-19
- Agent 记忆基质全面评估:揭示长期权衡 — Wei-Chieh Huang · 2026-08-19