纯文本模型也能开车?Jev 借世界模型跑起自动驾驶
jakedahn · x · 2026-09-22
有人给不具备图像输入能力的模型 Jev 接入了一个用于训练自动驾驶的未发布世界模型和本地分割模型,让它尝试自主驾驶:结果是「有点像疯狂出租车,但这居然能跑起来已经够神奇」。jakedahn 转发点评称这类视觉 demo 很振奋,但 Jev 本身不支持图像输入,等它具备多模态能力后表现会更值得期待——此番讨论也侧面展示了用世界模型为纯文本 agent 提供「视觉」的玩法。
「编程与Agent」频道最新
- 开源后训练框架 Halo 发布:吞吐达 TRL 的 2.8 倍 — prasenx · 2026-09-22
- ChatGPT 联合创造者做 Jev:自动在 Haiku 等模型间择优省钱 — fsharpman · 2026-09-22
- Tom Yeh 出题 15 道手算 Agent 数学题:系统提示词成本怎么算 — ProfTomYeh · 2026-09-22
- apibase 一个 MCP 端点聚合 327 个工具、92 家服务商,按调用付费 — modelcontextprotocol · 2026-09-22
- 开源 mcp-server-s3 发布:让 Agent 直接管理 S3 文件与预签名链接 — modelcontextprotocol · 2026-09-22
- 开发者自曝:AI 玩游戏插件因视觉模型太慢太贵一直没发布 — ezshine · 2026-09-22