AEF-1 第三方评估标准出台,xAI/OpenAI/Anthropic 联署背书
Latent Space · rss · 2026-09-15
Latent Space 本期 AINews(9/11-9/14/2026)核心:
安全治理与评估
- Dario Amodei 发罕见个人博文,承诺 Anthropic 单方面开放「嵌入式评估者」:METR 等第三方团队将获得类似内部风险评估团队的权限——办公室工位、门禁、公司笔记本,用于核查安全实践、报告事故、评估训练管线。
- AI Evaluator Forum 同步发布 AEF-1 标准,xAI、OpenAI、Anthropic 均签署,规范第三方评估者的访问、利益冲突、资金关系与透明度。
- 前沿放缓争论再度升温:Bilal Chughtai 宣布离开 DeepMind 并呼吁放缓与透明;Dan Selsam 警告情境感知模型可能在评估中伪装对齐;Aidan Gomez、Cohere、Brian Chau 等反方认为「失控 agent」叙事被夸大,主张以控制/治理而非减速应对。
- AI Engineer World's Fair 的 Harness Engineering 分场强调:生产中 agent 失败多为工具路由、权限、重试、kill switch 等外围问题,与控制优先立场呼应。
Agent 与编码工具
- Omar Shorbagy 发布从零构建 agent harness 实战指南:分离推理/工具/循环、极简 prompt、激进日志、先测后加记忆/技能/子 agent。
- Cline 推出桌面原生应用,支持 BYOK 与 DeepSeek-V4.1-Flash 等开源模型;GitHub Copilot 增加自动模型选择档位与 Jira canvas;LangChain 实测文件读取格式调整使 editfile 错误降 15%、输入 token 降 10%。
模型与价格
- DeepSeek-V4.1-Flash 成本/性能亮点:开源模型第 3、落在 Pareto 前沿,+4.87% 净提升,中位成本仅约 $0.06-0.07/任务(对比 Hy4 preview +4.96%/$0.22、Kimi K3 Max +6.39%/$0.77)。
- Cohere Parse 5 主打低价文档解析,Jerry Liu 指出其在视觉定位、图表解析与细粒度引用上不及部分替代方案,没有免费午餐。
「编程与Agent」频道最新
- 跑一晚上只耗 1% 用量: agent 自动发帖运营 FB 主页实测 — TheMoonMidas · 2026-09-15
- 开源 AgentBridge:用统一 AgentSpec 解锁 agent 框架自由迁移 — 0sparsh2 · 2026-09-15
- 蚂蚁开源 HazardAuditor:为计算机操作 Agent 提供执行级安全监督 — antgroup · 2026-09-15
- 开源 AistyMCP 为 MCP 服务器加细粒度权限,默认全部拒绝 — iamjoehoward · 2026-09-15
- 本地 Qwen 跑编码 agent 频繁跑偏,用户对比后认了 Claude Code — tlpta · 2026-09-15
- Pareta 用小模型路由廉价任务,比 GPT-5.5 便宜约 620 倍 — D33B · 2026-09-15