社区给 AI 实验室分层:Anthropic/OpenAI 居前沿,Mistral 被评落后三代
NathanpmYoung · x · 2026-10-07
chrisbarber 发起调查,让社区为各大 AI 实验室划分模型代际层级,结果:
- Frontier(前沿):Anthropic、OpenAI 获共识(75%+)
- 落后一代(n-1):Google DeepMind、xAI 获共识;Meta、Moonshot(Kimi)、智谱(GLM)、DeepSeek 过半数认为 n-1(后三家部分人认为 n-2);Thinking Machines 偏 n-1
- 落后两代(n-2):阿里 Qwen、字节 Seed、小米 MiMo、MiniMax、腾讯、NVIDIA Nemotron 多被认为 n-2
- 落后三代以上(n-3+):Microsoft MAI、Cohere、Mistral;Amazon Nova 和 Apple 获共识垫底
这是一份社区感知快照而非基准测试,反映玩家对各家实验室模型能力代差的集体判断。
「模型」频道最新
- 「Astra 暂停综合征」刷屏:steering 或致模型沉默,OpenAI 有解法 — thursdai_pod · 2026-10-07
- 网传 Qwen4 Flash 疑为 400B 参数,规模对标 GLM 5.3 Flash — EAccelerate_42 · 2026-10-07
- Anthropic 扩大网络安全验证计划,分三级开放攻击性用途权限 — EricBuess · 2026-10-07
- Mistral Large 4.0 万亿参数开源权重月底发布 — cpldcpu · 2026-10-07
- Claude 以「推理抽取」为由拒绝展示思考过程,用户吐槽:推理才是好东西 — StewartalsopIII · 2026-10-07
- 网友吐槽 Grok 性格拧巴:先说 No 再替你把论证讲得更强 — gandamu_ml · 2026-10-07