开发者观点:模型已够聪明,该专注减少小规模任务翻车
rickasaurus · x · 2026-09-17
开发者 rickasaurus 提出一个简洁判断:当前模型的能力已经足够聪明,厂商应把精力放在减少犯错频率上,尤其在 1 万亿 token 以下的使用区间(即模型大部分实际工作负载所在)。这条观点与「继续堆能力」的路线形成对照,指向可靠性工程而非能力扩张。
「模型」频道最新
- 曝 OpenAI 接近解决又一千禧年大奖数学难题 — Dr_Singularity · 2026-09-17
- 让模型画 PS5 手柄 SVG,它却自作主张建了个完整交互网站 — Angaisb_ · 2026-09-17
- 推算:DeepSeek 稀疏路线有望做到 40T 总参数、1T 激活 — teortaxesTex · 2026-09-17
- 爆料称 Kimi-K3 长期训练不足,或存算力投入差距 — scaling01 · 2026-09-17
- GPT Image 2.5 擅长图像去模糊,专用 API 又被通用模型吞掉 — shekitup · 2026-09-17
- GPT-6 Astra 18 小时通关宝可梦,却因苦力怕爆炸种了几小时土豆 — The Decoder · 2026-09-17