Jev 首晚实测:邮件分类 61 封对 60,成本仅 Sonnet 的两千分之一
EmergencyInitial8672 · reddit · 2026-09-24
一位 Reddit 用户分享了他把新模型 Jev 接入生产级邮件分类流水线的首晚实测:原本用 Sonnet 对收件箱按客户、项目状态等多维度打标,现在让 Sonnet 和 Jev 并行跑同一批邮件,再用 Opus 做裁判。
结果:61 封邮件中 Jev 被判定正确编码 60 封,与 Sonnet 表现几乎持平,但成本差距悬殊——Sonnet 处理同样任务花费 $19.46,Jev 仅 $0.01。作者询问是否有人在生产级 agent 架构中看到类似效果。
「编程与Agent」频道最新
- 给智能体做游戏的好处:AI 随时帮你当测试员改画面 — tristanbob · 2026-09-25
- DeepLedger 发布:面向 QuickBooks 的 AI 会计 MCP 连接器 — modelcontextprotocol · 2026-09-25
- AgentWallet MCP:给 AI agent 的免许可链上钱包基础设施 — modelcontextprotocol · 2026-09-25
- Agent 评测 SDK 亮相:用真实网站而非 mock 工具测试 agent — Able-Ingenuity8885 · 2026-09-25
- 新系统语言 With 发布:Rust 级安全加上 C 级直呼其名 — QuixiAI · 2026-09-25
- HuggingChat ML Intern 一条提示词 75 分钟自动训完 LoRA — Gradio · 2026-09-25