Sarvam AI 回应模型争议:7 个月用极少算力交付 R1 级模型

cneuralnetwork · x · 2026-08-28

针对 Sarvam AI 过去基于 Mistral 模型的训练争议及版权归属质疑,作者为其辩护。文中详细列举了 Sarvam 的技术成果:包括在 7 个月内用极少量算力(仅为 DeepSeek V3 的 1/50)交付了 R1 级模型、发布了 SOTA 语音与 OCR 模型。作者认为 Sarvam 展示了强大的后训练栈能力,并在印地语数据清洗与 token 移植方面表现优异,质疑在产品未公开发布的情况下讨论许可证缺失的合理性。

原文链接 →

「公司和人」频道最新

更多「公司和人」频道 AI 资讯 →