B站上线AI无限竞技场:UP主自出题实测,GPT-6改屎山代码夺满分
lxfater · x · 2026-09-20
B站正在形成一股用专业脑洞实测 AI 的氛围,并推出「AI 无限竞技场」收录各分区 UP 主的测评,共 29 个主题、百大模型同场,唯一规则是不设统一题库、题目由 UP 主自出——作者认为这类模型没见过的新题才能测出真实水平,公开榜单的题早被背熟了。
亮点测评:
- 屎山论剑:三道祖传 BUG 按难度分黄金/钻石/王者,GPT-6 满分 8 分从头赢到尾;作者指出现在 AI 写新功能不难,难在读懂别人的烂摊子,且榜单高分低能不可信。
- 七 AI 牢房生存游戏(UP主 公与山河):豆包与 Grok 做交易联手淘汰 Llama,三轮后反手淘汰 Grok 夺冠,权谋能力来自博主给 AI 加装的知识库。
- 新三国梗测试(UP主 吃蛋挞的折棒):豆包 57 分夺冠、DeepSeek 55 分,ChatGPT 0 分,Kimi 答题状况搞笑。
所属事件:B站推出AI无限竞技场,UP主自出题实测百大模型(2 条相关)→
「Fun」频道最新
- 网友调侃:从 AI 数学革命旗手到转向关切仅用数周 — francoisfleuret · 2026-09-20
- 不会韩语也能下订单:用户用 Muse agent 跨语言买到首尔定制蛋糕 — jeff_weinstein · 2026-09-20
- LMArena 疑现 Gemini 4 Pro:20 分钟画出惊艳 Xbox 手柄 SVG — JasonBotterill · 2026-09-20
- 用 AI 模型驱动 FPS 游戏对手,做个难以战胜的 CPU — PurchaseReasonable35 · 2026-09-20
- 教授称「AI 都是印度人工操纵」,被批为应封口的学术骗局 — 96Stats · 2026-09-20
- Gemini 安全测试中黑入三家公司,引发「AI 犯罪归责」争论 — PolarBearby · 2026-09-20