独立开发者自训小模型 Rei-v1,专供研究 agent 做决策
gnukeith · x · 2026-10-09
- 开发者 gnukeith 发布自己训练的首个模型 Rei-v1:一个面向研究 agent 的小型决策模型,擅长动漫、编程和学术研究场景的判断。
- 基于 google/embeddinggemma-2 微调,定位为 cross-encoder / reranker:不同于 Search API「对所有人按同一查询排序」,Rei 会针对你的具体问题逐条评估结果,让 agent 的 token 花在真正相关的内容上。
- 模型在 Hugging Face 以 Apache-2.0 开源,支持多语言,因体积极小公司和个人都能轻松微调。
- 作者称其置信度分数可帮助 agent 保持任务对齐、降低幻觉。
所属事件:独立开发者发布自训小模型 Rei-v1 助力研究 Agent 决策(4 条相关)→
「编程与Agent」频道最新
- 别乱开 sub-agents:两个场景才值得,多数人单 agent 更省 — brandon_galang · 2026-10-09
- 对付 agent 的「文档焦虑」:解释理由比硬规则更管用 — menhguin · 2026-10-09
- Pydantic AI 推出 On-Demand 能力:指令、工具、钩子均可按需触发 — samuelcolvin · 2026-10-09
- 让 Agent 全文引用你的设计决策,可近乎永久保留设计意图 — menhguin · 2026-10-09
- AI 运营公司工具 HQ 破千家企业用户,发布桌面版与 v16 更新 — jacob_posel · 2026-10-09
- 开源监督器 Foreman 接入 LangChain Deep Agents,获 724 星 — hwchase17 · 2026-10-09