实测对比:Qwen 3.8 Flash Next 处理 PDF 账单碾压新 Siri
sleight42 · reddit · 2026-10-09
作者做了一次小规模实测:给 Siri 一份医疗付款说明的 PDF,要求汇总付款金额,Siri 先是只取第一页的数值,被指出错误后跨几页求和仍然算错,作者最终放弃。同一份文档交给 Qwen 3.8 Flash Next(经 Hermes 调用),模型提取文本完成求和,还主动用视觉能力复核结果。作者结论:Siri 依旧不行,Qwen 3.8 小尺寸模型在行政类 agent 任务上表现出色,也少了一个换新 iPhone 的理由。
「模型」频道最新
- Qwen3.5 2B/4B/9B 纯文本 MLX 4-bit 包发布,最小仅 1GB — sachasayan · 2026-10-09
- 多语言 LLM 为何难做:字符解码与 BPE 是隐形瓶颈 — ivan_bezdomny · 2026-10-09
- Anthropic 启动 Cyber Mission:用前沿模型守护电网与开源软件 — AnthropicAI · 2026-10-09
- 669 项临床决策仅花 1.7 美分,开源模型医疗成本惊人 — antoine_chaffin · 2026-10-09
- Emad Mostaque:OpenAI 解 Navier-Stokes 花掉千万美元算力 — rohanpaul_ai · 2026-10-09
- 马斯克站台 Grok Bot:可调用 Opus 5.5、全量访问 X 数据 — elonmusk · 2026-10-09