llama.cpp 新增决策模型支持:一次前向出概率,最快 3 毫秒

kalyan_kpl · x · 2026-10-03

llama.cpp server 通过新的 /v1/systemone 端点支持「决策模型」:输入状态(文本、JSON 或截图)加带类型的问题,模型在单次前向传播中为每个选项返回概率,而非生成文本再解析。API 兼容 TypeSafe Jev 模型引入的 System One 格式。

所属事件:llama.cpp 新增决策模型端点,单次前向返回选项概率(5 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →