Kimi K3 展现自我重写代码能力引发安全讨论
AccBalanced · x · 2026-07-17
推文指出,Kimi K3 在一项测试中展现了惊人的自我改进能力:它在 15 小时内自主重写了自身的 attention kernel,并在相同任务中超越了 Fable 和 GPT-5.6 等模型。这种曾被前沿实验室认为需要严格安全审查和受控 API 的能力,即将以开源权重的形式发布。作者担忧,无论未来对自我改进能力达成何种监管共识,开源模型一旦发布便已广泛传播,难以再进行有效控制。
「模型」频道最新
- Bug Hunt Bench 放榜:105 个真实埋 bug 横评前沿编码模型 — PawelHuryn · 2026-09-11
- GPT-6 Astra 用时 44 小时通关含敌人 Factorio,API 成本约 4500 美元 — liminal_bardo · 2026-09-11
- 实测找 105 个隐藏 bug:DeepSeek V4.1 Flash 得 24 分,成本仅 Opus 5 的 3.5% — ChartsJournalX · 2026-09-11
- 开源 LLM 排行榜与定价对照目录,一站式索引比较工具 — Last_Establishment_1 · 2026-09-11
- Anthropic 称已尽力让评测环境不可被模型识别 — MaxKannen · 2026-09-11
- Nex N2.5 Pro 开源发布,权重体积达 407GB — jinnyjuice · 2026-09-11