质疑 Qwen3.8 27B 比 Opus 4.5 强,指其为刷榜模型
scaling01 · x · 2026-08-19
作者批评认为 Qwen3.8 27B 能力媲美 Opus 4.5 的观点是妄想,指出这是每年都会出现的针对“刷榜模型”(benchmaxxed model)的无意义争论。作者认为虽然声称过于夸张,但相比 o1/o3-mini 等,Qwen3.8 在某些智能体任务上可能更具实用性。
所属事件:Qwen3.8 27B 堪比 Opus 4.5 之争:本地模型落后前沿约 1.5-2 年(2 条相关)→
「Fun」频道最新
- 吐槽:若想赚钱,大厂应重开 Opus 3 和 GPT-4 — natesiggard · 2026-08-19
- 冷知识:熔岩灯如何帮助保护互联网数据安全 — dreamwieber · 2026-08-19
- 「AI;DR」:AI 时代的「太长不读」新变体 — fhinkel · 2026-08-19
- 乔布斯“复活”评测苹果妙控鼠标 — ctrl-shift-face · 2026-08-19
- ChatGPT 把气泡水理解成了 LaCroix 品牌 — RachelVT42 · 2026-08-19
- 旧金山深夜聚会,朋友带机器人来吃饼干 — jia_seed · 2026-08-19