Ministral 3 3B 纯 CPU 跑在 Galaxy S21 上,10 次全成跨双浏览器转发对话
Mean-Standard7390 · reddit · 2026-09-16
作者展示了一个边缘浏览器 Agent 实验:在三星 Galaxy S21 上,用 llama.cpp 跑 Ministral 3 3B(Q4KM,4 CPU 线程、无 GPU、电池供电),让它在 Chrome 里打开的 Gemini 与 Firefox 里打开的 Z.ai 之间中转对话——两个服务之间没有任何官方集成,手机上的模型同时操作两个网页界面,脚本负责搬运回复。
实测结果:10 轮连续测试全部成功,每轮 4 次浏览器跳转、共 40 条回复、20 次自动重置新会话;单轮 8 到 12 分钟,中位 9 分 29 秒;98 分钟系列耗电 16%。
关键发现在于「给模型看什么」而非模型多聪明:
- 脚本无任何站点特定条件或硬编码选择器,同一文件驱动两个页面
- 模型不接收截图或 HTML,只拿到一小段命名元素列表,回一行「选哪个」;Gemini 的 118 个页面节点被压缩为 2 个候选,Z.ai 的 124 个压缩为 4 个
- 对照实验:直接喂原始 HTML 时,Qwen3-0.6B 消耗约 25 倍 prompt token、耗时 17 倍,真实维基百科页面甚至塞不进手机上下文(0/3)
- 细节观察:Z.ai 有真假两个发送按钮,模型 20 连击全部选对;首次调用 9 秒,后续决策约 3 秒;JSON 输出格式不稳定(有时裸输出有时带代码围栏);10 轮中 1 轮触发重试恢复,已如实记录
脚本、带 SHA-256 哈希的公开 JSONL 日志与脱敏流程都在 GitHub(e2llm/edge-browser-agent)。作者强调这是单一场景的 harness,不是浏览器 Agent 基准。
「编程与Agent」频道最新
- 实测发现:Claude Code 开 bypass 权限后弃用内置工具改用 Bash — stablequan · 2026-09-16
- 开发者吐槽 AI 编码 harness 四大痛点:自动化散乱、只收单个 PR — blixt · 2026-09-16
- Qwen 27B 单卡5090本地跑出一个提示词生成8幕动画 — Acceptable-Object390 · 2026-09-16
- 37 岁非程序员用 Claude Code 做出 DnD 组队平台 Tavernly — DopeDutchLemon · 2026-09-16
- ChatGPT 内置 Sites 功能:一句提示词生成可发布网站 — TawohAwa · 2026-09-16
- 博主用豆包 Seed 2.1 做出卫星遥感版企业财报尽调工具 — karminski3 · 2026-09-16