讨论前沿模型的安全对齐与能力削弱
bindureddy · x · 2026-07-20
作者发文回顾称,Anthropic 及其 CEO 曾努力避免过度限制其模型的安全护栏。作者认为,当前中国模型(如 Kimi K3)已经具备了强大的网络安全能力,而美国本土的模型却因过度限制而能力受损。
所属事件:中美大模型安全护栏差异引发网络安全攻防担忧(3 条相关)→
「漫话AGI」频道最新
- AI 加速派反击末日论者:批对方只会人身攻击与表演式理性 — Dan_Jeffries1 · 2026-09-11
- ChatGPT 6 冲击就业?法国网友称 IQ 低于 130 的员工难有用途引争议 — mitchdeg · 2026-09-11
- 「AGI 已来」vs 现实:AI 实验室做的桌面应用依然又糙又卡 — MilesCranmer · 2026-09-11
- 社会学家 Harry Collins:LLM 无法发明新语言,做不了前沿科学 — whoamisri · 2026-09-11
- 「Waymo 效应」:AI 正在悄悄让科研协作变少 — JohnHammersley · 2026-09-11
- Anthropic 风险表态遭误引,2030 年毁灭概率争议再起 — davidmanheim · 2026-09-11