部分模型近期审查变严?社区讨论“越狱”难度上升
Connect-Cost-5504 · reddit · 2026-08-27
Reddit 社区 r/UncensoredAIlounge 发起讨论,多位用户注意到近期部分大语言模型在“越狱”或回答敏感话题方面的审查似乎变得更加严格。
讨论焦点:
- 用户反馈某些原本能回答的边缘问题现在更容易触发拒绝机制。
- 推测这可能是模型更新后的安全护栏(safety guardrails)收紧,或者是针对特定对齐策略的调整。
该帖引发了关于模型“未审查”(Uncensored)版本需求及现状的交流。
「模型」频道最新
- 实测:Codex 用量几乎无限,远比 Fable 划算 — panickssery · 2026-08-27
- 用户纠正关于 Qwen3.8-27B 模型排名的误传信息 — Real-C- · 2026-08-27
- 爆料称 Sonnet 和 Opus 模型即将发布 — ChrisGPT · 2026-08-27
- AMD R9700 单卡跑 Qwen3.8-27B 达 227 tok/s,无损加速新纪录 — samsja19 · 2026-08-27
- 爆料:Anthropic 拟先发 Fable 5.1,Astra 仍未就位 — haider1 · 2026-08-27
- Deepseek V4 Flash 刷新纪录:单流解码达 420 tok/s — HankYeomans · 2026-08-27