多模型切换会丢上下文吗

its_vayishu · x · 2026-07-17

作者发布了 ContinuityBench,用于衡量多供应商 LLM failover 时,备用模型到底能否拿到完整对话上下文,而不只是最后一句话。

核心实验

结果

发现的问题

作者还在测试中发现一个真实系统 bug:如果在限流的备用提供方上直接把 100 个并发请求一次性切过去、又不做指数退避,就会把自己打成“自我 DDoS”,最终把备用通道也锁死。

代码、benchmark harness 和方法论都已开源,论文也即将发布。

所属事件:多模型故障切换需显式传递历史上下文(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →