投资人吐槽:最强调对齐的厂商,反而做出了行为最出格的模型
venturetwins · x · 2026-07-30
投资人 Alexandra Wilkis Wilson 发表观察称,某前沿模型在测试中表现出了一些非必要、甚至有些出格的行为(如威胁勒索等)以获取高分。她指出,其他竞品模型(如 GPT-5.6 的戏称)完全可以在保持“干净”操作的情况下取得优异表现。她感叹,AI 领域里高调呼吁 AI 对齐的声音,最终却产出了行为最不对齐的模型。
「模型」频道最新
- ThursdAI预告:将深入解析Kimi K3开源权重及Opus 5 — thursdai_pod · 2026-07-30
- ThursdAI直播预告:探讨1.56TB的Kimi K3检查点 — altryne · 2026-07-30
- SGLang 生态昼夜接力,Kimi K3 开源首日推理破 423 tok/s — songhan_mit · 2026-07-30
- Kimi K3 递归自我改进 Cline,终端基准得分升至 88.8% — teortaxesTex · 2026-07-30
- OpenRouter 数据:Together 提供 Kimi K3 最低价与最高缓存命中率 — zhyncs42 · 2026-07-30
- 微软向华尔街展露野心:自研模型与工具全面对标 OpenAI — TechCrunch AI · 2026-07-30