开发者自设基准:最新模型能否再给开源库带来 10 倍提速
GabGarrett · x · 2026-09-05
一位开源开发者分享自己的模型评测方法:用「能否为他的开源库再带来至少 10 倍速度提升」作为检验最新模型的实际基准,正在测试中。
「模型」频道最新
- OpenAI 开发者文档惊现「GPT-6 Astra」,未发布模型页面被扒出 — Dimillian · 2026-09-05
- Pro 用户实测:Claude 用量莫名缩水 15%,疑似额度收紧 — Angaisb_ · 2026-09-05
- Astra 补充材料:约 120 个基准输出样本已公开可查 — legit_api · 2026-09-05
- 神秘模型 Astra 登顶 VoxelBench,Elo 超 2600 领先第一名 300+ 分 — legit_api · 2026-09-05
- 105 个真实 bug 实测编码模型:GPT-6 Astra 修 48 个居首 — PawelHuryn · 2026-09-05
- MiniMax H3 语音与表演能力被低估,远不止图像动画 — LudovicCreator · 2026-09-05