执业律师抱怨 Claude 模型差异不透明:跑半小时回「不知道」没法用
addicted2soysauce · reddit · 2026-09-18
一位使用 Claude 做法律文书与文档分析的律师发帖批评 Anthropic 在模型差异上过于不透明。
核心痛点:
- 律师工作常需要可预测的确定性答案:合同里某条款在不在、2000 页证据里有没有违约书面证据,Claude 跑半小时后回「I don't know」,无法区分是证据不存在、没听懂需求、还是找到了没识别出来。
- 即使是图纸/地图与地契解释的比对,也需要理解绘图者是如何制作的(是直尺连线还是实地走过),这超出简单的视觉叠加。
- 不同模型结果差异无解释:为什么 Opus 返回 12 个判例而另一个模型返回 14 个?这影响数百万美元诉讼的判断,而验证成本高到只能人工重做分析。
他提出的建议:
- Anthropic 至少应提供模型行为差异的「浅层解释」。
- 类比 LexisNexis 背景调查软件的安全审计模式,可设立 NDA 约束的「信任圈」订阅层级,或收取高额费用换取泄露赔偿保障。
- 他表示 Anthropic 的费用相对其项目收费微不足道,愿意为确定性付费。
「模型」频道最新
- PrismML 发布 Bonsai 2 27B:体积缩小 9 倍仅 5.9GB,保留 98.2% 性能 — alexcovo_eth · 2026-09-19
- MiniMax 新模型 H3 现身:官方仓库预告即将发布 — const_reborn · 2026-09-19
- The Information:OpenAI 接近攻克第二道千禧年大奖难题 Hodge 猜想 — _arohan_ · 2026-09-19
- 三值量化 Bonsai 2 27B 发布:体积缩小 9 倍仍保留 98.2% 性能 — alexcovo_eth · 2026-09-19
- TypeSafe 推出只能分类路由不能写作的 Jev,称比 LLM 快 200 倍便宜 400 倍 — aparnadhinak · 2026-09-19
- TypeSafe 新模型 Jev 非 LLM:输入按问题计费,输出免费 — altryne · 2026-09-19