微调提示词和状态,让模型仅凭视觉完成任务

mervenoyann · x · 2026-07-23

作者说自己稍微改了 prompt,并加入了一些额外状态,但仍然希望模型只靠视觉就能完成任务。

在回复里,他还让 Ben Burtenshaw 去看 OpenEnv,建议自己搭一个环境来做实验。整体更像是在讨论如何搭建和验证视觉型 agent 工作流,而不是单纯聊模型能力。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →