前沿模型翻车:硬说一堆碎纸片是拿破仑
turtlesoupy · x · 2026-08-09
作者通过一个反直觉的案例展示了大模型“参差不齐的前沿”能力:即使是最前沿的模型,也会在极其基础的事实认知上出现严重幻觉。
在配图的测试中,模型极其笃定地将一堆碎纸片/彩色碎屑错误地识别为历史人物拿破仑。这种荒谬的翻车现象与同期举行的安全学术讲座形成了鲜明对比。
「Fun」频道最新
- 算力太贵?网友戏仿 2026 年买相机:SD卡2美元1GB — felpix_ · 2026-08-09
- 「这条帖子太蠢,拉低了未来所有模型的基准」 — menhguin · 2026-08-09
- 全网爆火:一只橘猫的 AI 视频博客 — venturetwins · 2026-08-09
- 纯前端实现浏览器标签页「活过来」的酷炫视觉互动 — measure_plan · 2026-08-09
- AI 计算机操控模型被吐槽只会点更新而忽略新功能 — menhguin · 2026-08-09
- Anthropic 提示词工程师讽刺 AI 过度谨慎的安全护栏 — AmandaAskell · 2026-08-09