Baseten 联手 Goodfire 推 Project Beacon,为开源模型加推理时安全监测
baseten · x · 2026-10-10
推理平台 Baseten 宣布与 Goodfire AI 合作推出 Project Beacon,首次将开源模型推理与内联安全监测结合,让安全信号在生成过程中被主动捕获,而非事后补救。
要点:
- 核心思路是在生成时读取模型内部激活,定义主动安全策略,在输出到达用户或工具前检测并拦截不安全事件。
- 针对的风险包括 prompt injection、agent 越权执行策略外操作等推理层安全威胁,这些已成为企业采用 AI 的主要阻碍之一。
- 这是 Baseten 安全布局的延续:此前已推出 Base Labs 安全研究、与 Hugging Face 和 Goodfire 合作建设安全基础设施、参与 NVIDIA 的 Open Agent Safety Platform。
- 宣传中提到可将 OpenAI 的 safety commitments 用于 Baseten 上的开源模型。
「Infra」频道最新
- 降价刺激用量:AI 降价会否反而推高算力需求引争论 — dnlkwk · 2026-10-10
- Mike Jordan 团队新论文:用拍卖机制分配 LLM 推理算力 — nhaghtal · 2026-10-10
- SGLang-Diffusion 扩散模型推理框架将亮相 PyTorch 大会 — PyTorch · 2026-10-10
- 吴恩达:我的一个 agent 一天发起 5000–10000 次网页搜索,数据中心远远不够 — DeepLearningAI · 2026-10-10
- SGLang Summit 2026 议程公布:Intel/OpenAI/Perplexity 高管齐聚 SF — ying11231 · 2026-10-10
- AI 推理市场明年或从 1600 亿增至 3500 亿美元,软件毛利将承压 — Sethwinterroth · 2026-10-10