GLM-Edge-1.5B 跑在 4GB 老手机上,真实完成 Amazon 加购任务
Mean-Standard7390 · reddit · 2026-10-07
就在 TechCrunch 报道网站开始封杀 AI agent(如 Amazon 封 Meta Muse)之际,一个反向实验引起关注:未做任何微调的 GLM-Edge-1.5B-Chat(Q4KM GGUF 量化,llama.cpp 运行)在一台仅 4GB 内存的 Samsung Galaxy A04e 上,通过普通桌面 Firefox 会话在真实 Amazon 页面完成了购物任务——找到 24 节装 AA 电池和黄色橡皮鸭并加入购物车,两次运行均成功,全程约 8.5 分钟(Galaxy S21 上约 3 分钟)。
关键在架构:
- 模型本地运行,不是以独立 agent 身份访问网站,而是寄生在用户已有浏览器会话内感知和操作
- 不看截图也不吃原始 HTML,而是接收一层紧凑的结构化浏览器感知层(E2LLM/SiFR),只做每一步的小决策
- 由此把问题从「网站如何识别并放行 AI agent」转化为「用户浏览器会话内允许什么」,即 Browser-as-Shared-Space(BaSS):模型与用户并肩,而非取代用户的自治浏览器 agent
这延续此前的 Qwen3-0.6B(Note 8)、Ministral 3 3B(S21)端侧实验系列。
「编程与Agent」频道最新
- Nat Eliason 演示多 bot 协作下的优秀上下文管理实践 — nateliason · 2026-10-07
- Seaworthy 发布:让 AI Agent 打电话、付款、跑腿的单体 API — jefrankle · 2026-10-07
- 麦肯锡调查:32% 企业因 AI 编程工具放弃外购软件,科技业达 41% — import_jmr · 2026-10-07
- 开发者发起讨论:agent harness 工具冗余,是否需要统一的 meta-harness — yb2698 · 2026-10-07
- 换 harness 组件看模型表现:terminal-bench 任务在线实测 demo — yb2698 · 2026-10-07
- 开发者实测 5000+ ChatGPT 插件:模型只能真正看见几百个 — _nixa_ · 2026-10-07