Kimi K3识别风险但过于自信
ruthstarkman · x · 2026-07-18
有人评价 **Kimi K3**:它确实发现了风险点,但给出的置信度高于实际应有的程度。 这类反馈关注的不是功能发布,而是模型在风险识别上的行为表现: - 能找到问题 - 但可能过度自信 属于对模型可靠性与校准的实测型反馈。
所属事件:Kimi K3 安全强势但可靠性受疑(5 条相关)→
「模型」频道最新
- Qwen Cloud 推出6美元月套餐 — Scobleizer · 2026-07-20
- AI Overview 把历史讲成了幻觉 — teortaxesTex · 2026-07-20
- 关于 DeepSeek V4 路由争议的调侃 — teortaxesTex · 2026-07-20
- GPT-5.6 Pro据称解出IMO六题 — 量子位 · 2026-07-20
- Claude 按量计费到底贵多少 — Safe-Hovercraft6231 · 2026-07-20
- Kimi K3推理链既对也错 — teortaxesTex · 2026-07-20