印度小伙单人打造 5.84B 全模态开源模型,多项跑分超苹果 AFM 3B
That-Bookkeeper-8316 · reddit · 2026-09-11
来自印度比哈尔邦的 20 岁开发者 Abhinav Anand 发布 Arcle V1:一个 5.84B 参数的开源统一全模态基础模型,称数月前其单人建模宣言曾被广泛质疑甚至遭遇匿名抹黑网站攻击。
要点:
- 统一架构而非 API 拼接:文本、视觉、文档、语音输入投影到同一 2560 维语义空间,单次前向传播完成 7 项能力——对话推理、代码生成、多步数学、512x512 图像生成、文档阅读、语音识别与 24kHz 语音合成。
- 架构上下文窗口 2,097,152 tokens(200 万),支持 18+ 语言,刻意强化印地语与印度文化理解,完全离线运行。
- 对标 Apple AFM 3B:MATH-500 74.2% vs 48.0%,ARC-Easy 80.0% vs 71.0%,BBH 53.7% vs 44.2%,GSM8K 77.5% vs 75.0%,文档 OCR 内容词召回 94.6%。
- 训练算力由 Lightning AI(VP of Product Neil Bhatt)提供。
注意:评测为作者自述,未经第三方复现,真实性与训练细节仍待验证。
「模型」频道最新
- SuperGrok Heavy 用户将抢先体验最前沿功能 — Baconbrix · 2026-09-12
- Qwen3.8-27B 登陆 Cerebras,以极速推理跑出旗舰级成绩 — Scobleizer · 2026-09-12
- Astra 承认质量劣化:实验致 4000-5000 用户受影响,三项问题已修复 — TheMoonMidas · 2026-09-12
- 网友实测称 Gemini V4.1 知识截止疑至 2026 年 1 月 — teortaxesTex · 2026-09-12
- 爆料称谷歌逼近递归自我改进,或赶在 Anthropic 与 OpenAI IPO 前官宣 — beffjezos · 2026-09-12
- 开发者实测称 DeepSeek v4.1 Flash 明显优于 Gemini Flash — gaganghotra_ · 2026-09-12