博主实测:Grok 表现碾压其他所有模型
iruletheworldmo · x · 2026-10-08
一位拥有 11 万粉丝的博主称,他正在把 Grok 与市面上其他模型 extensively 对比测试,结果 Grok "全面碾压",能搞定他抛出的所有任务。他同时询问大家是否也有同感,或更偏爱其他模型。
「模型」频道最新
- Bengio 撰文驳「AI agent 入侵只是沙箱问题」,安全责任之争激化 — AlexTensor · 2026-10-08
- OpenAI 模型证明 Q 上希尔伯特第十问题不可判定,绕开 80 年老路 — aran_nayebi · 2026-10-08
- Anthropic 调整 $200 档后,该选 Opus 还是 Sonnet?播客拆解选型逻辑 — thursdai_pod · 2026-10-08
- AI 能证黎曼猜想却排不好周末行程?作者自嘲观点反转 — jxmnop · 2026-10-08
- OpenRouter 数据:用得最多的模型和被付费最多的模型正在分家 — Spiritual_Skirt_9312 · 2026-10-08
- 一句话方法论:把模型轻轻推出分布之外才有好答案 — _Stocko_ · 2026-10-08