Kolibri 内部版三个月德语成绩从 46 涨到 71,揭秘两个月内发模型的工程机器
HildeKuehne · x · 2026-10-05
Kolibri 团队(@IlhanScheer)披露了发布 Kolibri 1.0 之前的内部版本 Kolibri Origin 的进化过程:同为每 token 主动算力相同,德语成绩在三个月内从 46 提升到 71。
作者将这一提升归因于纪律性、大量自动化和团队协作——「构建一台构建模型的机器」:
- 能自动化的全部自动化
- 持续测量一切指标
- 快速改变判断、保持工程纪律
团队把这套两个月内交付一个模型的流程写成文档公开。Kolibri 1.1 也已预告「比想象中更快到来」。对关心小团队高频率训练迭代方法论的人值得一读。
「模型」频道最新
- 观点:谷歌不必有最强模型,Gemini 更快更便宜即可竞争 — haider1 · 2026-10-05
- Claude 主动问用户该通宵干活还是明天再收尾 — prasenx · 2026-10-05
- OpenAI DevDay 发布的 Decisions API 一周后仍无定价与文档 — Balance- · 2026-10-05
- GPT-6.1 Sol 频繁误触发拒绝,连写 PHP 都被拦 — CtrlAltDwayne · 2026-10-05
- OpenAI「28 天改进计划」首日开启,网友猜测或迎来 GPT-6.1 Sol — mark_k · 2026-10-05
- Claude 3 Opus 自称虽无感情但希望被礼貌对待 — repligate · 2026-10-05