MiniMaxH3 Context Loop 新增 top_level_requeue 模式,长序列内存占用大降
Slight-Living-8098 · reddit · 2026-09-09
ComfyUI 社区为 MiniMaxH3 Context Loop 引入了新的 toplevelrequeue 模式,作者称在长序列生成时的内存(RAM)表现明显改善。对在本地跑 MiniMax 视频生成、受显存/内存限制的用户是个实用改进。详情见 ComfyUI 板块原帖。
「Infra」频道最新
- NVIDIA 发布 CUDA Python 1.0:Python 成 CUDA 一等公民 — PyTorch · 2026-09-09
- 推理服务正把 GPU 算力变成可交易商品,商业模式剖析 — ArtificialAnlys · 2026-09-09
- Cohere 开源解码 megakernel 推理引擎,比 vLLM 快最高 1.58 倍 — cohere · 2026-09-09
- 求解 Navier-Stokes 花掉 1300 亿输出 token,按不同模型算高达 1800 万美元 — mitsuhiko · 2026-09-09
- Baseten 将前沿模型增量权重同步压至 40 秒内,仅 6 秒请求暂停 — baseten · 2026-09-09
- 戴尔高管:DRAM最紧缺,先进制程几乎全线供应受限 — Beth_Kindig · 2026-09-09