曝 Qwen4 内测成绩:前端编码接近 Opus 水准,10 月将至
julianharris · x · 2026-09-28
X 用户 @ItsmeAjayKV 爆料(未证实)称 Qwen4 内部测试结果已开始流出:内测集中在前端编码,水准大致与 Opus 5.5/Astra 同档,视觉品味优于 DeepSeek 0820;还提到将有 Qwen4-27B 小模型,期待 10 月发布。julianharris 转评调侃:连 Qwen3 都已无压力通过经典的「自行车上的鹈鹕」测试,该测试可能需要换代了。
「模型」频道最新
- 马斯克发帖确认 Grok 升级,用户实测速度明显变快 — elonmusk · 2026-09-28
- 一句话框架走红:System 2 建造大脑,System 1 在建神经系统 — ai · 2026-09-28
- TeleOCR 登上 HF 趋势榜:基于 Qwen2.5-VL 的中文文档解析模型 — XingChen-AGI · 2026-09-28
- Kaggle 推出 Game Arena:用国际象棋、德州扑克、狼人杀对抗评测 LLM — kaggle · 2026-09-28
- Perplexity CEO:日常知识工作仍用 sol 6,便宜快且压缩好 — gabriel1 · 2026-09-28
- NerfBench 首批复测:未发现 Claude Opus 5.5 被暗中削弱 — alejandroll10 · 2026-09-28