HasFIELD 呼吁投资独立验证机构,检验前沿模型安全护栏
ghadfield · x · 2026-09-30
作者(安全领域人士)指出:目前全球只有少数专家团队能独立测试前沿模型公司宣称的安全控制措施是否真实到位。这是“小萌芽”,但行业需要的是“参天大树”——需要资金、投资和人才尽快流入独立验证(verification)领域。
他提到加州已开始行动,而联邦层面的 FRONTIER Act 有望在全国范围内建立这一机制。
「安全」频道最新
- Anthropic 研究员新论文:投毒样本怎么选,后门攻击成功率 3% 到 80% — chhaviyadav_ · 2026-09-30
- 不同模型在无通信约束下给出相同答案,LLM 谢林点协调引安全担忧 — maksym_andr · 2026-09-30
- 回应 Anthropic 反开源论:开放权重对 AI 安全不可替代 — 1a3orn · 2026-09-30
- FTC 对 OpenAI、Anthropic 等 AI 实验室启动 AI 安全广泛调查 — Hesamation · 2026-09-30
- Google 报告:AI 时代月度漏洞披露半年翻倍至逾万条 — rseroter · 2026-09-30
- Agent 执行了错误退款谁负责?生产环境权限与问责框架引热议 — No-Conflict4823 · 2026-09-30