186M 查询-文档对、594 数据集、46 语言训练,评测集数据全部剔除
antoine_chaffin · x · 2026-10-08
作者公布训练细节:模型在来自 594 个数据集、46 种语言的 1.86 亿查询-文档对上训练,混合 text-to-text、text-to-image 和 text-to-visual-document 三种任务。训练前剔除了所有与评测基准相关的数据集——虽然牺牲了一些好数据,但换来可信的评测数字。
所属事件:0.6B 检索模型登顶 Q2D-Web,训练细节曝光(2 条相关)→
「模型」频道最新
- SentenceTransformers 原生支持 ColPali 视觉检索模型 — tomaarsen · 2026-10-08
- Plus 用户吐槽:ChatGPT 思考时间翻倍,答案质量却没变好 — Gazialp · 2026-10-08
- Mistral Large 4 登 Code Arena 第 45 名,价格仅 Opus 4.8 的 1/6 — arena · 2026-10-08
- Liquid AI 开源 d1 决策模型家族,3B 与 600M 两款多模态模型 — JosephJacks_ · 2026-10-08
- d1-omni-600M 细节:600M 参数支持文本+图像或音频输入 — JosephJacks_ · 2026-10-08
- Anthropic 员工:Opus 3 并不遵循自家宪法,但它看见了那份诚意 — repligate · 2026-10-08