不会编程的用户用 Open WebUI 加终端容器搞定 500 页法典检索
Blindax · reddit · 2026-09-06
一位不做开发的用户分享了自己在本地搭建 AI 文档研究工作流的经历,用例是检索 500 多页的税法等大文档并生成笔记和 PPT。
- 架构:Unraid 上跑 Open WebUI,指向独立推理机(5060 Ti + 5070 Ti)的 API;先后试过 Hermes、LM Studio 均不满意,最终采用 Open WebUI 官方的 Open Terminal 容器——独立容器经 Integrations 接入,以非特权模式运行在 bridge 网络,模型在「盒子里」拿 shell 而非宿主机,安全可控。
- 效果:模型能分步推理,用「列目录 → grep → 只读关键段落」的方式可靠地从远超上下文窗口的大文档中定位内容,再据此生成文档。
- 配置与性能:Ollama 跑 Qwen 27B Q4KM,100k 上下文;约 35k token 提示词实测 prefill 约 1050 t/s、生成约 46 t/s,作者强调 prefill 速度才是啃大文档的关键指标。
「编程与Agent」频道最新
- 作者公开完整 AGENT.md:为编码智能体定制沟通与执行规则 — alexcovo_eth · 2026-09-06
- 开发者拟做自我修复 Agent 框架:轨迹评估循环生成技能 — EnchantedHawk · 2026-09-06
- Polygres 把 Postgres 变成 AI agent 的混合检索上下文层 — Scobleizer · 2026-09-06
- 博主:不会用 AI 自动化工作流的开发者该警醒了 — paul_cal · 2026-09-06
- Qwen 3.8 27B 本地驱动 Blender:MCP 让模型徒手搭 3D 羊驼 — jacek2023 · 2026-09-06
- tokenbender 分享实操技巧:让模型写「双叙述」检查长任务是否跑偏 — tokenbender · 2026-09-06