用 Codex 跑 5 天枚举全网已发表 AI 安全点子
AaronBergman18 · x · 2026-09-29
Aaron Bergman 展示了一个实验:让 Codex 连续运行 5 天,用语义搜索尽可能枚举网上已发表的 AI 安全/灾难性风险缓解想法,并把它与 Coefficient Giving 的资助清单对照。
- Coefficient Giving 是资助 AI 灾难性风险缓解的慈善基金,页面列出多个「高优先级倡议」,明确表示愿意资助清单之外的相关项目,也欢迎已有团队申请
- 清单覆盖生物安全、全球灾难性风险机会、Navigating Transformative AI 等多个基金方向
- 作者的用意是认真(而非玩梗)地看待「把 AI 安全想法系统性盘点并用资金推动落地」这件事
「编程与Agent」频道最新
- Opus 5.5 联手 Runway MCP 做动态设计,附完整提示词 — notiansans · 2026-09-29
- 个人 Agent 产品 Pluto 开测:有邮箱、记忆和电脑,操作需人工审批 — Rasmic · 2026-09-29
- Anthropic 发布官方指南:用 Claude Code 自动构建 eval 并迭代优化 — ClaudeDevs · 2026-09-29
- Anthropic 员工提醒:别把 Sonnet 拉满 effort,该用 Opus — edwinarbus · 2026-09-29
- Hugging Face agent 攻击复盘:白名单限制去向,却管不住载荷 — kimmonismus · 2026-09-29
- Salesforce 工程师开源 PR Council MCP:多智能体代码评审实验场 — mostly_deterministic · 2026-09-29