Anthropic 的 Astra 推理多级监控机制曝光
AccBalanced · x · 2026-08-19
泄露的信息显示,Anthropic 正在为 Astra 模型实施严格的多级监控机制(CoT monitoring):
- 计算成本:监控带来约 20% 的计算开销。
- 响应机制:安全、安保和研究团队会在触发警报 30 分钟内收到呼叫,需核查是否为误报,否则停止运行。
- 监控架构:高阶模型用于“智能”监控,小模型结合规则检查每个采样 token;此前在评估和训练运行中未配置监控。
- 覆盖范围:每次使用工具的 Astra 推理都附带监控。
「Infra」频道最新
- Dyna-2 用 100 万小时第一视角视频训练,公开数据基建细节 — Scobleizer · 2026-08-19
- TensorRT Model Connect 开源发布,两条命令接入 HF 模型推理 — JFPuget · 2026-08-19
- 本地跑 AI Bot 噪音有多大?实测风扇狂转如喷气 — Daniel_Farinax · 2026-08-19
- 16GB M5 MacBook Air 跑 MiniMax H3:VPipe 比 h3.c 快 25% — TgoAI · 2026-08-19
- 英伟达垄断难破?唯有计算范式变革才能突围 — 2C_ornot2C · 2026-08-19
- Brex 报告:AI 热潮赢家是基础设施而非应用 — simonguozirui · 2026-08-19