用本地 Apple Intelligence 延长 Claude 用量
Unable_Strategy5135 · reddit · 2026-08-28
作者通过分析发现约 1/3 的 token 消耗用于重复读取旧上下文。解决方案是利用 Mac 本地的 Apple Intelligence 免费在夜间阅读并总结历史对话(生成移交记录:发生了什么、决定、下一步、涉及文件),第二天新对话直接基于总结开始,避免付费模型重复读取。配合 Haiku 处理特殊情况,成功将 token 利用率提升了 1/3。
「Infra」频道最新
- 三张 R9700 32GB 才抵一张 5090:本地玩家纠结换 AMD 阵营 — MrHall · 2026-08-28
- Vulkan 比 CUDA 低温 20 度还快:llama.cpp 后端选择实测心得 — Hot-Employ-3399 · 2026-08-28
- DeepSeek V4 Flash 定价疑云:如何做到与 GPT OSS 20B 持平? — gajesh · 2026-08-28
- Qwen3.8-Flash 训练成本仅需 Qwen3.7-Plus 九分之一 — VraserX · 2026-08-28
- 主权 AI 市场达 1.5 万亿,企业正逃离美云 — mikeflache · 2026-08-28
- ComfyUI 双卡部署实践:文本与 VAE 一卡、扩散模型一卡 — hurdurdur7 · 2026-08-28