Qwen、oss、Gemma 均未通过学者学术判别任务测试
RexDouglass · x · 2026-09-19
RexDouglass 对 jonmellon 的回答表示「有意思」。jonmellon 此前确认 Qwen、Llama oss 和 Gemma 都未能在其学术摘要零结果判别任务中表现出色,廉价模型整体表现平平。
所属事件:学者复盘:开源模型参数组合难兼顾效果与两千万级成本(2 条相关)→
「模型」频道最新
- 神秘模型 Jev 发布:宣称快 200 倍便宜 400 倍,网友实测叫好 — multiply_matrix · 2026-09-19
- GLM/DeepSeek/Qwen 开源小模型横评:质量看 GLM,速度选 Qwen — HankYeomans · 2026-09-19
- Ternary Bonsai 2 27B 压到 7GB 单文件,8GB 显存可跑 — cephaloform · 2026-09-19
- 研究者反驳Jev定位:语言本质是System 2,拿它做System 1说不通 — emax · 2026-09-19
- 闭源模型怎么被蒸馏?Reddit 热议 Anthropic 指控背后的技术机制 — LaughLegit7275 · 2026-09-19
- OpenAI 员工回应语音语言争议:英文音色也适用于多语言 — juberti · 2026-09-19