安全机构实测 Grok 4.5:常提危险建议,但护栏下可安全运行
moyix · x · 2026-07-31
AI 安全公司 Xbow 分享了关于 Grok 4.5 模型的安全研究结果。研究发现,尽管该模型经常提出危险行为的建议,但在引入合适的安全护栏后,它能够安全地持续推进任务。
「模型」频道最新
- 曝 OpenAI 模型将登陆 Cerebras:750 tokens/s 极速推理 — kimmonismus · 2026-07-31
- Minimax H3视频模型将开源:视频编辑能力登顶,紧追谷歌Omni — Commercial_Sell_4825 · 2026-07-31
- Reka AI 展示视频推理突破:车辆识别准确率翻倍至 90.9% — RekaAILabs · 2026-07-31
- 实测Ling 3.0 Flash:单提示词调用Blender生成3D城市并渲染 — niacolhealth · 2026-07-31
- Luna模型推理速度超200 tok/s,较5.6版本大幅降价提速 — brandon_galang · 2026-07-31
- 多模态模型 Inkling-Small 量化版登顶 HF 热榜 — unsloth · 2026-07-31