Astra 系统卡图表:Claude 与 Gemini 抗提示注入最稳,Luna 队最悬
andrew_n_carr · x · 2026-09-04
Andrew Carr 分享了 Astra 系统卡中一张测试模型对提示注入攻击鲁棒性的图表,指出几个观察:
- Claude 系列模型表现突出,Gemini 的鲁棒性也不错
- OpenAI 团队似乎在 Sol 和 Astra 两代之间取得了重要突破,鲁棒性明显提升
- Luna 团队的模型鲁棒性欠缺,作者调侃难以想象他们的压力
这是继系统卡发布后,社区对各家前沿模型安全护栏差距的第一批具体观察。
所属事件:GPT-6 Astra 发布:能力跃升伴随评测争议与可监控性下降(62 条相关)→
「模型」频道最新
- 微软发布 MAI-Transcribe-2:速度号称 10 倍于 GPT-Transcribe — ZacharyHuang12 · 2026-09-04
- 研究者质疑 Gemini 大面积故障传闻:谷歌全自建基建难有共因 — generativist · 2026-09-04
- ThursdAI 播客详解 OpenAI GPT-6 Astra:Arc-AGI 得分 99%、计算机操作能力惊人 — altryne · 2026-09-04
- Fable 5 对阵 GPT-6 ASTRA:3D 建模能力实测对比 — 141_1337 · 2026-09-04
- Astra 被质疑与涉险旧模型同源,UK AISI 报告引发信任争议 — GarrisonLovely · 2026-09-04
- GPT-6 Astra 隐藏亮点:跨上下文窗口保存笔记并检索早期记忆 — VraserX · 2026-09-04