Subnet 44 围绕 7B 视觉语言模型 Satori 扩张训练激励
richdotca · x · 2026-08-04
Subnet 44 正在围绕 Satori 扩张训练激励
转述内容显示,Webuildscore 正在为新视觉语言模型 Satori 提供训练激励。这个模型的目标不是只会“看图回答”,而是同时具备 推理 和 grounding 能力,也就是能把答案对应到图像中的证据位置。
- 可做 场景推理、目标检测/分割、文字识别、实体计数。
- 重点是让模型不仅能描述图像,还能 在像素层面证明自己的判断。
- 原文认为,很多 VLM 不是擅长推理就是擅长 grounding,而 Satori 想把两者结合起来。
- 目前计划从一个 7B base model 起步。
「Infra」频道最新
- 云厂商与 AI 供应商正在制造昂贵的锁定风险 — DavidLinthicum · 2026-08-04
- Swarms Cloud 更新:保存工作流、会话持久化与 1500+ 模型 — KyeGomezB · 2026-08-04
- SK 海力士将在印第安纳州动工 38.7 亿美元 HBM 封装厂 — rwang07 · 2026-08-04
- Kimi K3 据称可在 8GB CPU 上靠 SSD 流式推理 — porAssass · 2026-08-04
- AMD 财报前瞻:服务器 CPU 增长和 MI450 节奏才是关键 — tengyanAI · 2026-08-04
- OpenAI曾拟向Altman投资的Rain AI采购5100万美元芯片 — suchenzang · 2026-08-04