两年百倍爬坡改进,小模型已能写出高质量代码
menhguin · x · 2026-09-07
作者 menhguin 认为「LLM 能做什么、哪怕做得不好」本身很重要。他回顾:2022 年 LLM 除了标注和文案外对多数任务既无用也不划算,但已能看出它会写基础代码;到 2026 年,经过对任务的持续 hillclimbing 带来约 100 倍改进后,小模型已能写出相当好的代码。
他引用 merve 的观点补充:许多人喜欢用大模型「token 堆量」去解决传统 CV 技术栈(如 Hugging Face transformers 或 Roboflow)用不到 200 行代码、低延迟实时就能搞定的问题,这种用法并不合理。
所属事件:开发者回顾小模型两年百倍进化,视频成本将暴跌(2 条相关)→
「模型」频道最新
- AtCoder 43 场短程赛 Astra 拿 40 冠,Opus 5 近期成绩疑因训练污染下滑 — teortaxesTex · 2026-09-08
- 曾被指诈骗的印度 20 岁青年发布 5.84B 参数全模态开源模型 — That-Bookkeeper-8316 · 2026-09-08
- OpenAI Astra 展示 3D 交互:贴纸可沿最近边缘方向剥离 — arena · 2026-09-08
- 337KB 就能开口说话:sanoTTS 把 TTS 塞进 3 美元芯片 — alexcovo_eth · 2026-09-08
- AI 智能体 Astra 两局满分饱和 EBR-bench,还找到破坏游戏的卡牌 — Jsevillamol · 2026-09-08
- 曝 Grok 4.7 已在 Grok Bot 中悄悄灰度测试,发布临近 — mark_k · 2026-09-08