大厂内部可用无审查模型,Grok 成用户绕过 RLHF 首选
StewartalsopIII · x · 2026-08-29
作者指出 AI 实验室内部仍可访问未经 RLHF(基于人类反馈的强化学习)审查的模型,这意味着他们能体验到早期未过滤的对话模式。鉴于现在的 RLHF 越来越令人难以忍受,作者认为 Grok 是目前规避审查限制的最佳方案,并打算将非技术性咨询转向使用它。
「漫话AGI」频道最新
- 论文探讨生命系统中的时间与自我指涉 — drmichaellevin · 2026-08-29
- AI 投资回报被夸大?技术乐观主义忽视基本经济学规律 — aiamblichus · 2026-08-29
- 预测市场押注:下一个 Frontier Math 难题将由谁解决? — Polymarket · 2026-08-29
- AI 现实暴击:替代的是任务而非工作 — ingliguori · 2026-08-29
- 下一代 AI 将获战略连贯性,人机协作优势或终结 — flowersslop · 2026-08-29
- 基因传承 vs 数据永生:AI 学者提出未来存在新问 — francoisfleuret · 2026-08-29