用 sglang 评分端点微调推理,让开源模型秒变指定风格

BLUECOW009 · x · 2026-09-19

开发者 skeptrune 演示了一个惊人简单的推理工程技巧:不用微调,就能让任意开源模型表现出指定行为。他们甚至上线了一个恶搞性质的端点,叫 deepseek-v4.1-flash-jev 来证明效果。

核心做法:推理引擎 sglang 除了常规生成端点外还提供评分端点 /v1/score。在评分模式下,给定输入和一组候选答案,模型会被强制输出每个选项的概率而非流式文本,例如「abcccde 中最常见的字母」会返回 (c, 0.9) 这样的结构化分布。把 /gen 换成 /v1/score 即可实现。

利用这一机制对输出分布做工程化控制,就能低成本复制特定模型的行为风格。评论区有人戏称后续模型可能干脆自带「jev 选项」。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →