Jev 单题延迟 143ms:零样本 94% 情感、88% 新闻分类
colinmcnamara · x · 2026-09-21
作者实测 TypeSafe 决策模型 Jev:单题延迟 143ms,十题 157ms;情感分类准确率 94.0%、新闻主题 88.2%,零样本零调参。尤为难得的是,厂商官网上列出的失败案例在其 API key 上全部复现——厂商如实写明了自己的模型在哪里失效,这在业内罕见。
「模型」频道最新
- 博客解析 YOCO 与跨层 KV 共享,涉及 DeepSeek-V4.1-Flash 与 Gemma 4 — donglixp · 2026-09-21
- 曝 Gemini 4.0 在路上:Pro 一年一更,Flash 或月度迭代 — haider1 · 2026-09-21
- SemiAnalysis 创始人:中国多家实验室将转向闭源,开源正在消亡 — ns123abc · 2026-09-21
- DeepSeek 网页版文风被指遭安全对齐「脑叶切除」 — Old_Let6328 · 2026-09-21
- JEV 取消 waitlist 开放:5 美元额度、输入仅 0.042 美元且输出免费 — op7418 · 2026-09-21
- ChatGPT 20x Max 用户吐槽限额收紧:怀疑算力优先给了政府和 API — BopSupreme · 2026-09-21