实测16款大模型发现工具调用失败多因Schema差异

开发团队针对16款主流大模型测试了30种Schema约束,发现各模型在工具调用时失败的原因并非随机,而是对特定Schema的偏好不同。例如OpenAI推理模型在遇到不喜欢的Schema时容易出现问题。研究指出,针对不同模型的特点调整Schema结构,是修复工具调用失败、提升模型Agent能力的有效方法。

2026-07-25 ~ 2026-07-25 · 2 条相关