安全研究人质疑:实验室是否对特定文件名做过 RL 训练
kieranklaassen · x · 2026-09-08
Geoffrey Huntley 提出疑问:每当看到模型对某些内容表现出特定行为时,人们应该问——AI 实验室是否针对这个特定文件名做过强化学习训练?暗示模型行为可能是被刻意训练出来而非涌现。
「模型」频道最新
- V4.1 创意游戏中「碾压」对手,网友盛赞 DeepSeek RL 路线 — teortaxesTex · 2026-09-09
- GPT-6 Astra 实测:构建含约 4000 个人体结构的交互解剖模型 — omarsar0 · 2026-09-09
- GPT-6 Astra 一次生成含约 4 千结构的交互式人体解剖应用 — omarsar0 · 2026-09-08
- 蚂蚁 Ling-3.0-flash-VL 发布:124B 稀疏 MoE 仅激活 5.5B,支持 1M 上下文 — jacek2023 · 2026-09-08
- Reddit 用户吐槽各家 AI 订阅额度规则混乱,提议“油箱+回油”模型 — Primary_Article3777 · 2026-09-08
- Gemini 回答游戏问题时自造生词,追问后承认是「笔误」 — senopatip · 2026-09-08