实测对比:Qwen 3.8 Flash Next 处理 PDF 账单碾压新 Siri

sleight42 · reddit · 2026-10-09

作者做了一次小规模实测:给 Siri 一份医疗付款说明的 PDF,要求汇总付款金额,Siri 先是只取第一页的数值,被指出错误后跨几页求和仍然算错,作者最终放弃。同一份文档交给 Qwen 3.8 Flash Next(经 Hermes 调用),模型提取文本完成求和,还主动用视觉能力复核结果。作者结论:Siri 依旧不行,Qwen 3.8 小尺寸模型在行政类 agent 任务上表现出色,也少了一个换新 iPhone 的理由。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →