Google 演示称 Gemma 4 可在 6 秒内识别车损视频
soumitrashukla9 · x · 2026-07-22
Google 贴出一个 Gemma 多模态推理 演示,主打超高吞吐与车损识别场景。
- 原帖称 Gemma 4 跑在 Cerebras 上可达到 2300+ tokens/s。
- 这个 demo 会分析租车验车视频,并在 6 秒内 输出带框坐标的损伤报告。
- 转发者补充说,这些演示是自己在 Cerebras DevX 团队帮助下参与完成的。
「多模态」频道最新
- 先做分镜再生成,AI 舞蹈视频更容易保持一致性 — aftahi_ai · 2026-07-22
- 交互式视频更该看响应速度,而不只是画质 — Soggy_Limit8864 · 2026-07-22
- Runpod MCP 让 Claude 直接编排图像和视频生成工作流 — 802high · 2026-07-22
- Midjourney 把蜜蜂做成碎片爆炸梗图 — michaelrabone · 2026-07-22
- 物理奖励能改进视频生成,但不等于物理引擎 — Dapper-Drawer4546 · 2026-07-22
- HeyGen 给 coding agent 接入 7.5 万图片和 1 万音乐 — HeyGen · 2026-07-22