多模型实测拼解魔方,GPT速度夺冠DeepSeek成本最低

近期一场智能体能力实测让 Qwen、DeepSeek、Kimi 和 GPT-5.6 等前沿模型挑战“拼装并解开魔方”等复合任务。测试结果显示,各模型在速度、成本和策略上差异显著:GPT-5.6 Sol 完成速度最快,而 DeepSeek 凭借极低的推理成本在复杂 Agent 任务中脱颖而出,展现出极高的性价比优势。

2026-08-06 ~ 2026-08-07 · 2 条相关