8 小时同题实测:9 个大模型与本地模型在 RTX 3060 上拼前端开发
zyxciss · reddit · 2026-09-20
作者用完全相同的前端开发提示词(为虚构高端工作室 NOVA//LABS 构建单页网站,要求避免典型 AI 风格 UI),在 RTX 3060 12GB + 16GB 内存的 CachyOS 上对比 9 个模型,并录制生成过程供读者自行评判。
前沿模型参照
- Gemini 3.8 Flash(经 Antigravity):约 3 分 12 秒,约 9K tokens
- GPT-5.6 Sol:约 1 分 06 秒,速度极快
- Claude Sonnet 5:约 4 分 56 秒
本地模型(llama.cpp)
- Bonsai 2 27B Ternary:原生三值/约 2-bit,模型仅 7.66GB,34–36 tok/s,本次消耗约 52K tokens(上下文上限约 122K),耗时约 45 分钟
- Qwen 3.8 27B GSQ-RCO-IQ3-XXS + MTP:10.4GB,开启高推理,满上下文约 29 tok/s、空上下文约 40 tok/s,上下文压缩两次,实际可用约 49K,耗时约 57 分钟,作者认为是本地模型里最有趣的
测试重点是「模型实际造出什么」而非解释代码的能力,生成视频已公开。
「模型」频道最新
- 把 Claude 各档模型比作交通工具:Haiku 自行车到 Fable 母舰 — __rum_ham__ · 2026-09-21
- 传闻:OpenAI 神秘 Bell 模型瞄准数学与编程「窄域 ASI」 — VraserX · 2026-09-20
- 小米 MiMo V2.6 训练直播 4 天半烧掉 324 万美元 — teortaxesTex · 2026-09-20
- Resetwatch 插件一页聚合 14 家 AI 服务用量与额度重置时间 — Teknium · 2026-09-20
- Sebastian Raschka:若有 1 亿美元做顶级 LLM,首选给现有模型做后训练 — MaziyarPanahi · 2026-09-20
- 腾讯发布 Gander:边聊天边后台干活的智能体 — The Decoder · 2026-09-20