DeepSeek新模型引热议:16B模型ARC-AGI-2达80%,质疑蒸馏传闻
teortaxesTex · x · 2026-08-15
在X上,用户@teortaxesTex回应关于DeepSeek的传闻,指出DeepSeek并未“搞砸”,并质疑“10T模型”或“Mythos教师”存在的证据。他提到一个16B模型在ARC-AGI-2上达到80%的成绩,认为仅凭1-2个评估不足以证明Mythos-Preview优于Mythos。同时,他观察到推理机队扩张,暗示成本降低可能是证据。
所属事件:DeepSeek 表现引热议,10T 模型传闻遭质疑(2 条相关)→
「模型」频道最新
- DeepSeek 正开发 Flash 变体:拟让 250B 模型具备 3T 编程水平 — bindureddy · 2026-08-15
- Qwen3.8-27B性能引热议,网友调侃谷歌反应 — max_paperclips · 2026-08-15
- 开发者将AI9Stars G9v3-39A5B量化至GGUF并创建llama.cpp分支支持 — linuxid10t · 2026-08-15
- Gemini 3.5 Pro检查点更名Gemini 3.7 Flash High,引发猜测 — Rare_Bunch4348 · 2026-08-15
- Perplexity 发布 Agent API 与网页搜索基准评测 — AravSrinivas · 2026-08-15
- 争议:DeepSeek 未翻车,质疑 10T 模型真实性 — teortaxesTex · 2026-08-15