Anthropic「宪法」被指名不副实:本质就是 RLAIF 省人力标注
WillRinehart · x · 2026-09-22
研究者 Will Rinehart 回应《纽约时报》关于 Anthropic 宪法的报道(原报道称其中充满“鼓励 Claude 把自己视为有偏好和内在动机的真实实体”的明确指令),指出这名字很糟糕——宪法式 RL 本质上就是一种 RLAIF(用 AI 反馈做强化学习),其真正的好处是大幅降低人类标注有毒/有害内容的时间、成本与心智负担。针对 NYT 式“AI 被赋予自我意识”的解读给出了更技术的祛魅。
「模型」频道最新
- Grok 4.7 发布:AA 评测仅次 Opus 5,成本约一半 — NicoVerderosa · 2026-09-22
- Whittle 蒸馏模型走红 Reddit,27B-A3B 声称可在 8GB 显存笔记本跑 — depressedclassical · 2026-09-22
- 开发者控诉:每月付 $500 用 Claude,限额缩水撑不满一周 — TejasKumar_ · 2026-09-22
- 用户称 Gemini 把「有人要杀我」误判成自杀倾向,只回热线清单 — WideImagination8644 · 2026-09-22
- Claude Code 用量重置会同时保留全球与银行式重置? — Angaisb_ · 2026-09-22
- 云栖大会爆料:Qwen4 已在训练,Qwen4.5/5 将冲 5-10 万亿参数 — ChrisGPT · 2026-09-22