DecBench 要衡量 LLM 距离近乎完美去编译还有多远
moyix · x · 2026-07-23
帖子介绍了一个名为 DecBench 的新评测站,目标是衡量二进制去编译(binary decompilation)距离“近乎完美”还有多远。
作者的观点是:LLM 可能很快会成为世界上最强的去编译器之一,因此需要专门的评测来追踪这一领域的进展。配图排行榜按 Union / Structure / Types / Recompile 等指标对多个 decompiler 排名,其中 Codex 和 Claude Code 处在前列。
「模型」频道最新
- 按语言拆分的代码表现,暗示一个简单路由器 — zainhas · 2026-07-23
- Kimi K3 级联 Sol 解题率升至 85.6%,单题 $7.30 — zainhas · 2026-07-23
- Kimi K3 更像差一点,GPT-5.6 Sol 更容易破坏基线 — zainhas · 2026-07-23
- Kimi K3 max 对比 GPT-5.6 Sol max:更像路由问题 — zainhas · 2026-07-23
- Kimi Delta Attention引入记忆遗忘门,LSTM架构正回归大模型 — burny_tech · 2026-07-23
- 用户触顶 ChatGPT Pro 200 美元额度,吐槽降级太隐蔽 — Sauers_ · 2026-07-23