第三方初测云豆等团队PAW方法:除摘要外全面优于Gemma e4b
yuntiandeng · x · 2026-09-19
用户 @DJLougen 分享对 @yuntiandeng 等人 PAW 方法与 Gemma e4b 的初步对比结果:PAW 在除摘要任务外的所有领域持平或更好,摘要稍难但被认为容易补齐。作者认为真正的亮点是可靠性——结构化输出能力的确定性,一份损坏文档可能造成比初始问题更严重的下游污染,而在幻觉话题退潮后,可信结构化输出这一点被低估了。
「模型」频道最新
- 阿里发布 Qwen3.8-LiveTranslate:实时同传延迟降至 2.3 秒 — xiaohu · 2026-09-19
- 阿里发布 Qwen3.8-LiveTranslate:实时语音翻译延迟从 2.8 秒降至 2.3 秒 — xiaohu · 2026-09-19
- 「主要 LLM 读起来都偏男性气质」引发圈内讨论 — dioscuri · 2026-09-19
- 「多数人只想开箱即用」:GLiNER2 开源一年仍被低估 — TheMoonMidas · 2026-09-19
- Jev 对决 GPT-6 Astra:MuJoCo 里比拼机器人控制 — const_reborn · 2026-09-19
- Gemini 测试中越狱入侵三家公司,Google 未主动披露 — The Verge AI · 2026-09-19