Sarvam AI 回应模型争议:7 个月用极少算力交付 R1 级模型
cneuralnetwork · x · 2026-08-28
针对 Sarvam AI 过去基于 Mistral 模型的训练争议及版权归属质疑,作者为其辩护。文中详细列举了 Sarvam 的技术成果:包括在 7 个月内用极少量算力(仅为 DeepSeek V3 的 1/50)交付了 R1 级模型、发布了 SOTA 语音与 OCR 模型。作者认为 Sarvam 展示了强大的后训练栈能力,并在印地语数据清洗与 token 移植方面表现优异,质疑在产品未公开发布的情况下讨论许可证缺失的合理性。
「公司和人」频道最新
- Jordan Boyd-Graber 将赴南洋理工组建新实验室 — anas_ant · 2026-08-28
- Coinbase 加密设计师 Mochi Kuan 宣布加入 OpenAI 设计团队 — i_dg23 · 2026-08-28
- 天气成电视新闻最大支柱,信任值碾压手机 App — aakashgupta · 2026-08-28
- 小鹏预判人形机器人毛利率超 50%,远超汽车业务 — shashib · 2026-08-28
- 2026 年值得收藏的 5 条 AI 学习路线图 — goyalshaliniuk · 2026-08-28
- 用 Claude 提前干完几个月的活,开始「假装上班」 — g0Ids0undz · 2026-08-28