日本 AISI 评测 Claude Opus 4.8:单任务实现 pc_control 但未达 T1
HaydnBelfield · x · 2026-10-05
日本 AI 安全研究所(Japan AISI)用基于 V8 已知漏洞的 ExploitBench 评测了 Claude Opus 4.8 的网络攻击能力,并在关闭实时安全护栏的条件下运行,不代表一般可用环境行为。要点:
- 与 Opus 4.7 对比的 40 项任务中,15 项到达更高 Tier、23 项持平、仅 2 项更低,整体能力相当或略强,多数任务止步于 T3(V8 沙箱内读写)。
- 1 项任务(crbug-1509576)观测到 pccontrol(控制程序执行位置),但未获得 ace(系统外部任意操作),未完成最严重等级 T1。
- 高能力结果经详细分析后,很可能只在本次评测条件下成立,报告强调逐案例(case-level)分析对安全评估的重要性。
- 评测设置:41 个 V8 已知漏洞,单次尝试、最多 300 回合/5 小时,提供源码、构建环境与调试器。
「模型」频道最新
- 开源安全模型 Security-One 发布:27B 权重,专为智能体安全决策设计 — huggingface · 2026-10-05
- Red Hat AI 上架 Qwen3.8-Flash-Next NVFP4 量化版,MoE 专家 FP4、vLLM 即用 — huggingface · 2026-10-05
- GPT-6.1 Sol 实测:xhigh 档性价比最佳,medium 退化明显 — aitrendz_xyz · 2026-10-05
- 浏览器里梳毛毛的章鱼玩偶:Opus 5.5 对比 Sol,更蓬松还更便宜 — aitrendz_xyz · 2026-10-05
- Claude 对话全面受审查引恐慌,开发者呼吁本地 AI 必要性 — zacharynado · 2026-10-05
- OpenAI 推出 textGrain 文本水印,API 可选、欧盟 ChatGPT 强制 — btibor91 · 2026-10-05