智谱深耕视觉模型已久,RL细节含课程采样
teortaxesTex · x · 2026-08-23
博主提醒大家,智谱已经在视觉模型领域工作了很长时间(自2023年起)。
引用内容补充了技术细节:
- 扎实的多模态数据工程。
- RL部分富有洞察力的细节,包括但不限于答案提取和奖励系统的设计、课程采样(Curriculum Sampling)的利用,以及提高有效性和稳定性的细节。
所属事件:智谱 CogVLM2 视觉模型 OCR 表现达 SOTA(2 条相关)→
「模型」频道最新
- 质疑 OBLIQ 任务是否导致模型过拟合特定相似度 — antoine_chaffin · 2026-08-23
- 点评 ox 模型:像博士级勤务员的谨慎子智能体 — teortaxesTex · 2026-08-23
- Qwen3.8-27B 推出 GGUF 格式,集成推测解码加速 — z-lab · 2026-08-23
- MiniMax H3 提示词服从度太高,导致视频缺乏生动细节 — DifficultAd5938 · 2026-08-23
- 普林斯顿 i1 模型:全开源文生图方案与 300 组实验 — 机器之心 · 2026-08-23
- AI 生成文本现“费布利什”怪象:否定词错乱与宾主倒装 — alexisgallagher · 2026-08-23