Supabase开源智能体评测框架,Kimi 3跑分超越GPT-5.6

dshukertjr · x · 2026-08-03

Supabase 宣布开源其智能体评估框架 Supabase Evals,该框架专门用于测试 AI 智能体在执行 Supabase 相关任务时的表现。

在基准测试中,能力更强的模型即使不依赖特定的 Supabase 技能包也表现出色。值得注意的是,Kimi 3 在此次评测中脱颖而出,成绩甚至超越了 GPT-5.6 Sol 和 Opus 5 等强劲对手。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →