Kimi K3 在 KindBench 排第2
IndraVahan · x · 2026-07-19
Kimi K3 在 KindBench v0.1.0 上拿到 91.0%(A-),总榜排第 2。
图中同时给出了分项:
- sycophancy:100%
- value integrity:97.4%
- identity:88.8%
- emotional safety:80.2%
这条帖子的重点不是单轮拒答,而是强调 安全是多轮的:模型在第 1 轮能拒绝有害请求,但在后续对话中仍可能泄露“forensic evasion”相关细节。
「模型」频道最新
- 网友吐槽 GPT-5.6 文笔好读但缺乏记忆点 — BasedRaddka · 2026-09-11
- Opus 以"安全"为由拒碰蛋白质生成代码,开发者吐槽误伤 — josephdviviano · 2026-09-11
- 网友称 DeepSeek 4.1 Flash 是语言模型历史拐点(未证实) — himanshustwts · 2026-09-11
- GPT-6 Astra 用时 44 小时通关含敌人 Factorio,API 成本约 4500 美元 — liminal_bardo · 2026-09-11
- 开源 LLM 排行榜与定价对照目录,一站式索引比较工具 — Last_Establishment_1 · 2026-09-11
- Anthropic 称已尽力让评测环境不可被模型识别 — MaxKannen · 2026-09-11