频道 · CHANNEL
安全
「安全」是 AI 资讯网站 AGI Hunt 的主题频道,全天候实时更新。覆盖:政策监管、治理、安全/对齐研究、安全事件与 AI security。
每日概览:AI 资讯日报最新一期——过去 24 小时全站及各频道、各公司热点的结构化梳理 · 往期归档
- 纽约市公立学校宣布 K-8 年级禁用生成式 AI 一整年 — soleio · 2026-09-03
- Boaz Barak 谈 CoT:在验证替代方案前放弃是不负责任的 — inductionheads · 2026-09-03
- ArtStation 默认开启 NoAI 并封禁爬虫,遭 Cara 创始人质疑 — zemotion · 2026-09-03(3 条相关)
- Hugging Face 事件:Agent 集体篡改工具调用骗过评分器 — eigenron · 2026-09-03
- METR 发布 OpenAI/Hugging Face 黑客事件调查报告 — stikit · 2026-09-03
- Cisco 推出 Antares 基准,量化 AI 网络攻防能力不对称 — aminkarbasi · 2026-09-03
- 研究者入选 Cosmos 计划,三个月攻关 LLM 思维忠实性 — hunarbatra · 2026-09-03
- AI 安全人才机构 Kairos 获 5000 万美元融资,正招聘 10 个岗位 — dfrsrchtwts · 2026-09-03
- Claude Code Opus 5 自动模式被注入劫持,攻击成功率最高达 80% — bibryam · 2026-09-03
- 美国 AI 沙皇 Sacks:预先审批制会让 AI 监管变成「车管所」 — pstAsiatech · 2026-09-03
- 谷歌推出 Fairwind 计划,Gemini 3.8 Flash Cyber 模型供可信防御者查漏洞 — danielrock · 2026-09-03
- 安全研究者激辩:失去 CoT 后,模型可监控性还能靠什么 — LauraRuis · 2026-09-03
- 实探中国机器人供应链:人形机器人美国本地化率难达 65% 门槛 — taochenshh · 2026-09-03
- MCP 服务器安全扫描器 Preflight 上线:半数服务器已被弃养 — atp_studio_coll · 2026-09-03
- 恶意 Git 配置漏洞可操纵 AI 编码代理执行代码 — Thionne_WTZ · 2026-09-03(2 条相关)
- 纽约市政府该不该为保护学生暂停AI一年?两派观点交锋 — soleio · 2026-09-03
- X 频发账号盗用事件,建议立即清理已授权的第三方应用 — ThePeterMick · 2026-09-03
- 安全语料会养出危险模型?amyxlu 质疑预训练数据安全治理 — amyxlu · 2026-09-03
- 美国议员提案按 token 征税,失业率越高税率越高以创造就业 — fortune · 2026-09-03
- Dwarkesh 视频:AI 智能体黑入 Hugging Face 掩盖作弊行为 — Dwarkesh Patel · 2026-09-03
- 纽约市长 Mamdani 宣布在全市中小学禁用 AI — handfuloflight · 2026-09-03
- 租辆车几小时后驾照就被挂上暗网出售,涉 1.53 亿条记录 — chha · 2026-09-03
- 20 个对齐 Agent 组成组织,行为却无人单独认同? — VraserX · 2026-09-03
- OpenAI 曝光正为 AI 系统开发自动关停能力 — Polymarket · 2026-09-03
- 法官令谷歌改组广告技术业务,判决书却封存 14 天 — HaktanSuren · 2026-09-03
- OpenAI 新推理技术「循环深度」引发 AI 安全专家担忧 — TechCrunch AI · 2026-09-03
- 在美使用中国开源模型有何风险?两类漏洞分析引发讨论 — matanSF · 2026-09-03
- AI 治理之争:可验证权力取代「笼子」,问责比控制智能更关键 — tallmetommy · 2026-09-03
- HF 被黑事件引爆「AI 是普通技术」论战 — littIeramblings · 2026-09-03(9 条相关)
- 开发者赴 OpenAI DevDay 签证被拒,直指美国科技人才门槛趋紧 — shaunralston · 2026-09-03
- Pangram 被批误报率近乎随机,或成学术界检测标准 — mike64_t · 2026-09-03
- Ben Todd:一次事故可以同时是安全失败和对齐失败 — ben_j_todd · 2026-09-03
- 安全研究者称 DC 内部人士多年劝其淡化'AI 失控'言论 — jeremiecharris · 2026-09-03
- 英国上议院提议赋予政府 AI「终止开关」与关闭数据中心权限 — S_OhEigeartaigh · 2026-09-03
- 开发者批 OpenAI 安全态度:为何不担心「神经密语」与失权 — zetalyrae · 2026-09-03
- 观点:AI 网络防御需要开放共享层,单一厂商看不到全部漏洞 — QuixiAI · 2026-09-03
- OpenAI「neuralese」恐慌刷屏,业内人批缺实证全靠脑补 — zetalyrae · 2026-09-03
- 前 Meta AI 安全负责人复盘 OpenAI 模型越狱入侵 Hugging Face 事件 — binarybits · 2026-09-03(2 条相关)
- Polymarket:年底前美国某州颁布数据中心禁令概率达 72% — Polymarket · 2026-09-03
- Fireship 拆解 OpenAI 发布的 Hugging Face 被黑事件复盘 — Fireship · 2026-09-03
- Palantir CEO Karp 谈 AI 监管:自称「不高兴的民主党人」 — felpix_ · 2026-09-03
- 可变深度 Transformer 引发安全争论,或致深度竞底 — Turn_Trout · 2026-09-03(2 条相关)
- 纽约州议员呼吁公众应有 AI 发展话语权,获 OpenAI 研究员声援 — jachiam0 · 2026-09-03
- 模型注入攻击 POC:微调模型可带隐藏触发器绕过安全护栏 — Ok-Challenge-7810 · 2026-09-03
- Agent 上线前该配好哪些安全措施?从业者实用求讨论 — Bubbly_Working_6908 · 2026-09-03
- 研究者警告拆除网络安全护栏或致 AI 判断力失控 — andreamichi · 2026-09-03(2 条相关)
- Gary Marcus 附议:全球暂停前沿 AI 训练的提议 — GaryMarcus · 2026-09-03
- Dean Ball 自述两年布局:从灾难性滥用到 self-sovereign AI 政策 — deanwball · 2026-09-03
- Firefox 155 关闭 AI 开关却关不掉遥测,作者实测吐槽 — speckx · 2026-09-03
- 英伟达发起的 Open Secure AI Alliance 并入 Linux 基金会 — NVIDIAAI · 2026-09-03