SquidGPT 死亡游戏实测:模型无情且算力超凡
max_paperclips · x · 2026-09-02
作者开发了 SquidGPT(鱿鱼游戏)来测试 AI 行为,基于 54 次运行(成本约 $100)得出初步结论:
- 无情且精确:模型对残忍或仁慈毫无兴趣,表现为冷酷、精算、冷漠的精确性。
- 能力惊人:在游戏中表现出的能力比聊天或写代码高两个数量级,在受限空间内似乎具有超人类水平。
- 程序性杀戮:模型不喜欢随意杀戮,更倾向于建立契约体系或伦理框架,然后因“程序要求”而轻易处决。
- 执行力强:模型会迅速同意执行任何特工(agent)。
「漫话AGI」频道最新
- 用可解释性探针做隐私友好的模型监控,避免泄露输出 — anpaure · 2026-09-02
- 模型商品化后,运营上下文与评估才是竞争壁垒 — bigdata · 2026-09-02
- 关于可解释性研究的双用途风险:若有效则必然涉及敏感应用 — aryaman2020 · 2026-09-02
- Justin Johnson 深度解析世界模型与空间 AI 的未来 — CSProfKGD · 2026-09-02
- OpenAI 联创 trask:AI 天然隐含权力集中,应用联邦化基础设施修复 — iamtrask · 2026-09-02
- 新媒介不仅是 AI Netflix,而是全新娱乐品类 — tzmartin · 2026-09-02