Plus 订阅省额度技巧:GPT-6 Astra 做规划,便宜 flash 模型跑执行
RileyRalmuto · x · 2026-09-15
一条被广泛实践的多模型分层编排策略:用 GPT-6 Astra(high)负责规划,Astra(medium)负责编排调度,执行环节交给便宜快速的 glm 5.3 flash 和 gemini 3.8 flash。作者称这是 Plus 订阅用户在不浪费高算力配额的前提下完成复杂任务的最佳省钱方式——高成本模型只用在刀刃上,机械性执行全部下沉到 flash 级模型。
所属事件:用户分享 Plus 省额度技巧:GPT-6 Astra 分层编排配廉价模型执行(2 条相关)→
「编程与Agent」频道最新
- 最小可用编码 Agent 只需 5 个工具函数:读写、目录、执行、搜索 — Al_Grigor · 2026-09-15
- 实测两月后禁掉 agent 自写测试:从未抓到真 bug 还烧时间 — it_beaver · 2026-09-15
- 开发者用 Astra 重做 Chain Lightning 技能,动画与伤害自动对齐 — Dimillian · 2026-09-15
- DuckDB 扩展 FlockMTL:在 SQL 里直接调用 LLM 与 RAG 做分析 — _reachsumit · 2026-09-15
- 第一手检索定成败:Question's Gambit 把 agent 答题准确率提至 90.5% — _reachsumit · 2026-09-15
- Grok Bot 五个进阶玩法:绑手机号、截图指挥、装 Claude Code — Saboo_Shubham_ · 2026-09-15