同上:大模型写后端代码排行榜完整榜单已公布
karminski3 · x · 2026-09-14
博主补充发布此前大模型写后端代码(从零实现向量数据库、按数据库性能计分)评测的完整榜单链接与配图。
核心结论同前:Fable-5.1 峰值最高(21191.51)但三次波动超 50%,GPT6-Astra 三次得分 12985.28 / 12134.83 / 10676.74 最稳定;DeepSeek-V4.1-Flash 性价比最佳,得分接近 Kimi-K3 且波动 <20%。
所属事件:实测大模型从零写向量数据库:Fable-5.1 峰值最高但波动大(2 条相关)→
「模型」频道最新
- 网友实测称神秘模型 instinct 体验胜过 Grok 与 Muse — Scobleizer · 2026-09-14
- Kokoro 语音模型移植 Core AI:54 种声音 iOS 端侧零成本运行 — amos_gyamfi · 2026-09-14
- Hacker Opus 之后多层模拟评测或已失效,研究者劝评估者慎用 — herbiebradley · 2026-09-14
- 黑客松观察:人人都在刷 benchmark,没人敢做真实场景 — hackgoofer · 2026-09-14
- 开发者吐槽:用 astra 9 秒烧掉 30 美元 — haydendevs · 2026-09-14
- 开发者晒用量:编码/研究/数据分析 90% token 花在开源模型 — xeophon · 2026-09-14