独立开发者吐槽 Together AI 限流:多 Agent 并行测试寸步难行
Correct_Positive_108 · reddit · 2026-10-07
一位独立开发者表示在开发 Agent 式代码仓库索引与 benchmark 生成工具时,在 Together AI 上频繁撞上 RPM/TPM 限流。他并行运行多个 Agent,使用 Llama 3.3 70B、Qwen 2.5 等模型。
他指出模型本身没问题,问题在于免费/低档位额度无法支撑有意义的并发测试;升级到企业档位对没有营收的个人开发者并不现实,发帖寻求对开发者友好、实验额度充足的推理服务商推荐。
「Infra」频道最新
- 为什么 2019 款 Mac Pro 才是本地 LLM 的理想机器 — Odd-Capital-847 · 2026-10-07
- RL 训练团队爆料:1T 全量权重同步低于 5 秒 — saurabh_shah2 · 2026-10-07
- NVIDIA 发布 UNREAL:一个模型统一语料检索与 128K 长上下文 — nvidia · 2026-10-07
- SlimWise 解耦 MoE 前后阶段专家剪枝,解码吞吐最高提升 1.81 倍 — Gunho Park · 2026-10-07
- Ora 扫描 10 万+网站:仅 5% 对 AI Agent 友好,平均分 41 — EdenEmarco177 · 2026-10-07
- 重训 DFlash 2 草稿模型,27B 三值模型 L4 提速 2.2 倍 — naklitechie · 2026-10-07