实测大模型从零写向量数据库:Fable-5.1 峰值最高但波动大
博主以「让大模型从零实现向量数据库、按数据库性能计分」的方式连续三次实测多款模型的后端 Agentic 编码能力,并公布完整榜单。结果显示 Fable-5.1 仍居 SOTA,最高分达 21191.51,但三次成绩波动超过 50%,稳定性欠佳;相比之下 GPT6-Astra 表现最稳。该评测为衡量大模型实际工程编码能力提供了直观参考。
2026-09-14 ~ 2026-09-14 · 2 条相关
- 自建向量数据库实测:Fable-5.1 夺冠但波动超 50%,GPT6-Astra 最稳 — karminski3 · 2026-09-14
- 同上:大模型写后端代码排行榜完整榜单已公布 — karminski3 · 2026-09-14