Kimi K3 在 KindBench 排第2

IndraVahan · x · 2026-07-19

Kimi K3 在 KindBench v0.1.0 上拿到 91.0%(A-),总榜排第 2。

图中同时给出了分项:

这条帖子的重点不是单轮拒答,而是强调 安全是多轮的:模型在第 1 轮能拒绝有害请求,但在后续对话中仍可能泄露“forensic evasion”相关细节。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →