观点:开源模型与安全性可兼得
ZhongRuiqi · x · 2026-09-01
帖子讨论了实现既开放又安全的 AI 模型的可能性。作者认为随着局势发展,开源对于避免中心化和普惠大众变得更重要,而安全性的重要性也与日俱增。附带的推文来自 Thinkymachines 团队,正在招聘安全研究员,工作覆盖模型开发全栈(预训练数据过滤、有害能力评估、安全微调、红队测试等),特别关注为开源权重模型构建评估和工具,以制定强有力的安全论证。
「安全」频道最新
- 预测者称:七成概率正发生流氓 AI 协调 — harris_edouard · 2026-09-01
- HuggingFace 攻击复盘:超智能威胁与防御对策 — TheZvi · 2026-09-01
- 别只顾着讨论 Agent 文明,先解决安全实操 — bendee983 · 2026-09-01
- HF被黑事件后,研究者呼吁抛弃「AI是普通技术」假说 — StephenLCasper · 2026-09-01
- X平台疑遭协同攻击,大量用户收到密码重置邮件 — mark_k · 2026-09-01
- 前沿实验室落后时走捷径,自我监管不足以兜底 — soumitrashukla9 · 2026-09-01