登山者照 Gemini 建议被困山中:模型越强,信任校准越难

Dapper-Tale-4021 · reddit · 2026-09-08

作者把两件事放在一起思考:9 月 1 日,三名 Roseville 登山者用 Gemini 规划 Mount Shasta 登顶,AI 建议携带远少于实际需要的食物和水,结果他们 19 点才登顶、超过建议折返时间 4 小时,夜间下山时一人膝盖受伤,被困峡谷一夜后才被护林员救出;Google 称无法复现那些错误回答。两天后 OpenAI 发布 GPT-6 Astra,宣称 ARC-AGI-3 达 99.9%、FrontierMath Tier 4 达 97.6%、ExploitBench 100%,开启「AGI 时代」,而 Artificial Analysis 的独立评测显示 Anthropic Fable 5.1 在综合智能指数上仍领先。

作者核心论点:两者并非孤立事件——模型每变强一分,就有更多人在更高风险场景信任它;能力提升并不会自动弥合「模型实际能力」与「使用者对局限的理解」之间的鸿沟,反而因输出更有说服力而更难管理。从事企业 AI 落地咨询的作者称,最常见的不是人们对 AI 过度怀疑,而是不知道何时该停止信任。

所属事件:登山者听信Gemini建议被困引AI信任反思(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →