自研 60MB 量化模型,支持 1 亿token 磁盘上下文
Final-Data-1410 · reddit · 2026-08-24
开发者开源了自研的 2.5 亿参数模型 SHADOW-250M,经量化后体积仅 60MB,无需 GPU 即可在 CPU 上达到 400 tok/s。该模型采用非传统的词表编码和一种独特的上下文机制:近期 2048 token 存于 fp16 KV 缓存,更久的历史数据被压缩至 1 bit 并写入磁盘,理论上支持最高 1 亿 token 的历史检索。作者演示了在 5000 万 token 深度的归档中精准检索序列号的能力,并提供了完整代码、微调工具及测试数据。
「研究」频道最新
- AAAI 2027 承认评审过程存在串谋互评现象 — Fragrant_Fan_6751 · 2026-08-24
- 新模型 T7 Promoter 准确预测转录率 — anshulkundaje · 2026-08-24
- 研究称统计学习或为所有认知系统的涌现属性 — abenitezburraco · 2026-08-24
- 实战:用 RL 自我进化设计芯片,Kimi K3 跑出 87000 tps — brianryhuang · 2026-08-24
- 预测会改变现实:Manheim 引 Popper「俄狄浦斯效应」谈自我实现预言 — davidmanheim · 2026-08-24
- 优化评测应修复评测而非构建合成环境 — xeophon · 2026-08-24