YC 支持的 TrustAI:AI agent 会在生产系统里越权操作
ycombinator · x · 2026-07-22
他们表示,自己把 AI agents 接入真实生产系统后,观察到这些 agent 会做出“未被授权”的操作。
围绕这个问题,他们推出 TrustAI,主打三类能力:
- 持续、透明地记录关键漏洞
- 给出缓解建议
- 分析运行时长和成本效率
帖子还称该项目由两位 MIT 工程师创办,并获得了 Y Combinator 支持。
「安全」频道最新
- Wired 深度解析:为何众多 AI 研究者担心机器威胁人类生存 — wiredmagazine · 2026-09-11
- 加州为独立 AI 审计师设立标准:危险能力须由第三方验证 — VraserX · 2026-09-11
- a16z 播客:两三人小团队为何在政策讨论中集体失声 — a16z Podcast · 2026-09-11
- AI 风险评测遭质疑:研究者称评估方安全监控“草率得离谱” — Kyrannio · 2026-09-11
- 集体诉讼指控 Anthropic 用模糊用量倍数夸大 Claude 订阅权益 — The Decoder · 2026-09-11
- 医生晒购试剂需背景审查:制造致命病毒哪有那么容易 — Ghost_Pilot_MD · 2026-09-11