BPBench 显示中文开源模型压缩能力领先
ctnzr · x · 2026-07-25
这条转发讨论的是 BPBench:把一个预训练 LLM 当作“压缩器”,模型越能理解语言,压缩从未见过文本所需的比特数就越少。
它测的是训练截止日期之后发表的新鲜人类文本,方法是:
- 对文本做前向计算
- 用 log probabilities 算 bits-per-byte(bpb)
作者的结论是:在开放权重模型里,压缩能力最强的基本都是中国模型,只有 NVIDIA 的 Nemotron 是明显的西方例外,处在前沿簇里。
他还指出,商业 API 往往不开放 logprobs,因此很难直接做这种压缩测量;用采样去估计又太噪,无法还原分布尾部,所以对闭源 API 做 KL / log-prob 蒸馏也会非常困难。
「研究」频道最新
- HF 工程师争论:非生成任务全用因果注意力是在浪费算力 — antoine_chaffin · 2026-09-11
- 智利学者:AI 反馈规模化是医学教育可持续的关键 — julianvarascom · 2026-09-11
- Nature 新研究实现全身器官细胞活动成像,揭示跨器官体级回路 — arjunrajlab · 2026-09-11
- SignNet 1M 手语数据集发布 — ducha_aiki · 2026-09-11
- ECCV26 口头论文:流匹配实现多视角点云配准 — ducha_aiki · 2026-09-11
- InFlux++ 方法发布 — ducha_aiki · 2026-09-11