把长文本压缩成图片:SnapCompact 省下 2/3 Token 成本
arpit_bhayani · x · 2026-08-03
Stencil 团队提出了一种名为 SnapCompact 的上下文压缩技术:放弃传统的文本摘要,转而将长文本渲染成密集的像素字体位图(PNG 图片)交还给模型阅读。
核心数据与实践效果:
- 容量与成本:一张 1568x1568 像素的 PNG 图片可承载约 4 万字符。如果按常规 Token 计费需约 1 万 Token,但作为图片输入(使用 6x10 像素字体),Anthropic 仅计费约 3,279 Token,成本直接压缩至三分之一。
- 模型理解力:多模态大模型并非仅仅是在“看图”,而是能近乎逐字地精准读取图片中的文本内容。
- 字体阈值:字体大小对识别率影响显著。存在一个约为 40 平方像素/字符的“断崖式”临界点,低于该阈值模型完全无法识别,高于它则能平滑读取。
所属事件:SnapCompact技术将长文本转为图片大幅降低Token成本(2 条相关)→
「编程与Agent」频道最新
- Cloudflare 发布 Agent 运行时:为智能体提供轻量级「电脑」 — craigsdennis · 2026-08-04
- GitHub 连发四项 Copilot 支出限制,会话级软上限仍存失控风险 — shashib · 2026-08-04
- 招募内测:让本地 Codex/Claude 自动解决 arXiv 论文难题 — mhmazur · 2026-08-04
- 告别AI味废话:开发者分享「去水化」提示词技巧 — sh_reya · 2026-08-04
- Mu:为 AI 智能体打造的轻量级开源工具包 — No-Cream3565 · 2026-08-04
- AI 智能体自我迭代优化 vLLM,DeepSeek 等模型吞吐量提升 16% — yisongyue · 2026-08-04