原理拆解:为何 logits 能模拟 jev 式分类输出
michellechen · x · 2026-09-19
作者解释:虽然不知道 System One 模型的完整内部架构,但可以用现有语言模型近似其接口。语言模型输出词表中每个 token 的 logits 分数,softmax 将其转为概率,logprobs 则以对数空间表达这些概率——这些分数比最终选中的 token 携带更多信息。配合合适的输入与提示词,就能构造出模拟 jev 式分类模型的概率分布。
所属事件:开发者用 logprobs 让 LLM 输出概率化决策(2 条相关)→
「编程与Agent」频道最新
- Claude Code 用户分享会话管理技巧:让 AI 自动整理侧边栏会话 — steipete · 2026-09-19
- Jared Palmer 用 Devin 通宵跑 autoresearch,再训 0.6B 小模型 — AAAzzam · 2026-09-19
- 开源 Observer v3:本地 LLM 盯屏幕的微 agent 监控框架 — Roy3838 · 2026-09-19
- 作者开源耗时 3 周打造的 MiniMax H3 全能 ComfyUI 工作流 — altoiddealer · 2026-09-19
- Muse 接入 Plaid 自动记账,Robinhood 流水直写预算表 — alexandr_wang · 2026-09-19
- 开源引擎 Inco Splash 让 Qwen3.8-27B 在 M5 Max 跑出 144 tok/s — ResearchCrafty1804 · 2026-09-19