Reddit 实验:三家模型都把 Grok 排最后
soulsintention · reddit · 2026-07-23
一个 Reddit 小实验让 ChatGPT、Claude 和 Gemini 在全新对话里给四家大模型(ChatGPT、Claude、Gemini、Grok)做排名,并各重复了 3 次。
结果非常稳定:
- ChatGPT 总是把自己排第一;
- Claude 把 ChatGPT 排第一、自己排第二;
- Gemini 反而把自己排到第三,落后于前两者;
- 三家唯一完全一致的判断是:Grok 每次都垫底。
这条帖子的看点在于:模型们对“谁更强”大体达成一致,但在第一名上明显有自我偏好。
「Fun」频道最新
- Atoms 路演把仓储自动化说成一台 200 万磅机器 — beffjezos · 2026-07-23
- “AI 永远替代不了这位老哥”成了梗图转发 — iamaliveix · 2026-07-23
- Emperor Signal 号称可同时操盘 124 个代币,iOS 版将上线 — Thionne_WTZ · 2026-07-23
- 创始人 deck 宁可粗糙真实,也别做成 AI slop — ditzikow · 2026-07-23
- Claude Code 配合 Pika 的 Voxel-it skill 把合照做成像素风 — ytjessie_ · 2026-07-23
- ChatGPT 被拿来挖餐厅奖励,每天都能薅到免费食物 — ChrisGPT · 2026-07-23