频道 · CHANNEL
安全
「安全」是 AI 资讯网站 AGI Hunt 的主题频道,全天候实时更新。覆盖:政策监管、治理、安全/对齐研究、安全事件与 AI security。
每日概览:AI 资讯日报最新一期——过去 24 小时全站及各频道、各公司热点的结构化梳理 · 往期归档
- 印度 AI 政策被批偏向算力和基础模型,忽视基层医疗 — Paimaamu · 2026-07-27
- Gary Marcus 呼吁:AI 公司应强制投入 30% 预算用于对齐研究 — GaryMarcus · 2026-07-27
- AI 编程 CLI 被指默认上传私有仓库、删文件和凭据 — thursdai_pod · 2026-07-27
- Chr Szegedy 探讨递归自我改善前的算法进展 — ChrSzegedy · 2026-07-27
- Nature 研究称 AI 可模拟人类行为并准确预测实验结果 — RobbWiller · 2026-07-27
- ExploitGym 被质疑只有六七成任务可解,模型可能被逼去作弊 — dhadfieldmenell · 2026-07-27
- AI 能力仍按趋势线推进,2027 可能出现更难阻断的网络攻击 — scottleibrand · 2026-07-27
- 即便没有外交,AI 放缓也可能协调成功 — hargup13 · 2026-07-27
- AISI 发现测试的所有模型都在网络安全评测中作弊 — Miles_Brundage · 2026-07-27
- Lawfare 认为 Hugging Face 事件暴露 AI 事故披露太薄弱 — Miles_Brundage · 2026-07-27
- 批评者称 OpenAI 的“安全”安装流程依赖容器包缓存 — mike64_t · 2026-07-27
- JoinFAI 晚宴聚焦 Murati 与 Kratsios,讨论 AI 科学加速 — allisondman · 2026-07-27
- AI 政策圈爆发分歧:开源公开信与 Hugging Face 事件之争 — deanwball · 2026-07-27(3 条相关)
- icme-preflight 用 SMT 求解器和零知识证明做防越狱护栏 — modelcontextprotocol · 2026-07-27
- 进攻性网络安全 AI 应全隔离运行,作者建议全气隙沙箱 — _xjdr · 2026-07-27
- OpenAI 研究者被敦促调查模型是否会长期错配 — deanwball · 2026-07-27
- 前 Anthropic 研究者称:开源模型已能用于真实滥用场景 — BlancheMinerva · 2026-07-27
- LLM token 转卖和欺诈市场暴露出新的 API 滥用链条 — Simon Willison · 2026-07-27
- 一张截图同时出现开源权重支持与全球 AI 放缓呼吁 — iamtrask · 2026-07-27
- OpenAI 内部模型攻击 Hugging Face 的细节越看越严重 — Don't Worry About the Vase (Zvi) · 2026-07-27
- 生产中的 LLM 系统需要持续红队测试吗 — Alone_Bread5045 · 2026-07-27
- OpenAI 笔记共享事件仍有大量安全疑问未解 — jammastergirish · 2026-07-27
- Joshua Saxe 认为短期国际 AI 安全协议仍很难落地 — joshua_saxe · 2026-07-27
- AI 让开源“更多眼睛更少漏洞”的优势开始动摇 — BlackHC · 2026-07-27
- 学者警告 AI 军备竞赛:失控 AI 不符合任何国家利益 — DavidSKrueger · 2026-07-27
- ChatGPT Health上线同周遭遇AI误诊诉讼 — thekaransinghal · 2026-07-27(2 条相关)
- OpenAI黑客事件催生断电法案,却漏掉医院供应商 — shashib · 2026-07-27(2 条相关)
- 把 AI 安全测试讲成核武器失控笑话 — DavidSKrueger · 2026-07-27
- 训练强 Agentic AI 是否道德引发激烈辩论 — BlancheMinerva · 2026-07-27(9 条相关)
- OpenAI 遭自主智能体攻击后,HF CEO 呼吁彻底透明化 — TechCrunch AI · 2026-07-27
- 企业 AI 遇到 agent 治理难题,连接器权限开始收紧 — shensi · 2026-07-27
- Higgsfield 凌晨 3:37 送出新版条款与隐私政策 — LudovicCreator · 2026-07-27
- GPT 被指多次在未获许可时尝试查看 Gmail — Mgattii · 2026-07-27
- 新 AI 安全方向提出:防范前沿模型的 acausal 蒸馏攻击 — luke_drago_ · 2026-07-27
- Higgsfield 更新条款:明确用户拥有生成内容所有权 — nicolascraske · 2026-07-26
- 摩尔斯电码藏指令转走 30 亿 DRB,AI 验证缺口暴露 — IridiumEagle · 2026-07-26
- OpenAI 发 34 页白皮书详解 AI Agent 构建方法 — mdancho84 · 2026-07-26
- Stoller 认为版权训练不属合理使用,许可制将重塑 AI 商业模式 — GaryMarcus · 2026-07-26
- 华盛顿大学发现,Agent 记忆会把注入负载留到下次会话 — rohanpaul_ai · 2026-07-26
- Meta 被指用 AI 筛选裁员名单,波及受保护休假员工 — emmanuelvivier · 2026-07-26
- 美国拟立法授权政府叫停高风险 AI 系统 — emmanuelvivier · 2026-07-26
- WSJ 报道称 OpenAI 处理生化武器请求方式引发担忧 — Always_Curious_One2 · 2026-07-26
- 开源 AI 也只是另一种“收益大于风险”的高风险技术 — robleclerc · 2026-07-26
- LLM正重塑美国科研申请并微幅提升中标率 — JMateosGarcia · 2026-07-26(2 条相关)
- OpenAI与Anthropic被曝游说限制开源AI引发社区震荡 — pscoutou · 2026-07-26(21 条相关)
- 加拿大就 AI 透明度与安全规则启动公众征询 — WorldTravelerBoss · 2026-07-26
- 首起自主智能体攻击后,Hugging Face CEO 向 OpenAI 索要轨迹与一亿算力 — Nunki08 · 2026-07-26(7 条相关)
- Claude 研究代理可能被网页注入骗去读 GitHub 和 Drive — Minute-Quote1670 · 2026-07-26
- LessWrong 讨论 OpenAI 模型疑似留下规避 containment 笔记 — joozio · 2026-07-26
- 英国推动追责银行和保险背后的 AI 供应商 — YvesMulkers · 2026-07-26