普林斯顿 i1 模型:全开源文生图方案与 300 组实验
机器之心 · wechat · 2026-08-23
普林斯顿大学刘壮团队发布了 3B 参数的文生图模型 i1。该模型基于 300 多组控制实验和 70 万 TPU 小时训练,使用了完全公开的代码和数据。i1 在五项基准上平均领先此前最好的全公开模型 29.5%,且在文字渲染能力上表现优异。研究发现:多文本编码器效果可被单一大规模 adapter 替代;长 caption 训练需配合 prompt rewriter;高分辨率训练不需要广泛数据覆盖也能保留能力。
「模型」频道最新
- 点评 ox 模型:像博士级勤务员的谨慎子智能体 — teortaxesTex · 2026-08-23
- Qwen3.8-27B 推出 GGUF 格式,集成推测解码加速 — z-lab · 2026-08-23
- MiniMax H3 提示词服从度太高,导致视频缺乏生动细节 — DifficultAd5938 · 2026-08-23
- AI 生成文本现“费布利什”怪象:否定词错乱与宾主倒装 — alexisgallagher · 2026-08-23
- 实测:Terra 胜过 Sonnet,Flash 速度质量无敌 — cgarciae88 · 2026-08-23
- 用户报告 Gemini 答非所问:代码问题换来澳洲税号科普 — mic_n · 2026-08-23