TensorSharp 结构化读取让本地决策 API 快 3.3 倍且零解析失败

fuzhongkai · reddit · 2026-09-24

TensorSharp 维护者发布重大更新:本地实现 Jev 核心决策 API(noul/choice/score 三类决策),并通过可选 images 字段扩展到图像分析,单请求最多支持 8 张内联图片,图像嵌入直接进入结构化决策路径,无需「先描述再分类」的中间步骤。

核心方法:受 vLLM PR #57250 启发,采用一步式结构化读取——prompt prefill 后直接从 answer canvas 读取标签 logits,由服务端序列化为 JSON,模型无需逐 token 生成概率 JSON;共享同一 canvas 的问题可共用一次前向传播。

实测对比(12 案例 × 3 重复,与同后端的 LocalJev 生成 JSON 方式对比):

作者明确说明这些是纯文本结果,不声称图像场景有同等加速。可用 DiffusionGemma Q4KM GGUF(约 2.8GB 视觉分片)本地运行。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →