前沿 AI 法律研究基准成绩已可比肩律师
Sanity · x · 2026-10-04
Sanity 发帖指出,前沿 AI 模型在部分法律研究基准测试上的表现已经能与律师竞争。不过他也提醒:基准测试成绩并不等同于真实的法律结果,实际法律工作中的复杂性仍远超基准。
「模型」频道最新
- Astra 自称无法确定自己是否有主观体验 — VoidStateKate · 2026-10-04
- Qwen3.8 Flash Next 激进优化,或为 Qwen4 快速铺路 — demomanca · 2026-10-04
- 马斯克团队晒 Grok Bot 实用案例,网友对比吐槽 ChatGPT Dot 假响铃 UI — elonmusk · 2026-10-04
- 「不是 X 而是 Y」:RLHF 式对冲话术正在污染人类表达 — sloppenheimer · 2026-10-04
- 日报:StartLux 决策模型登顶,OpenAI 日烧 50 万美元查智能体 — 创业邦 · 2026-10-04
- 曝 GPT-6 Sol Codex 29.4 万字符系统提示词泄露,1902 行指令被扒 — 新智元 · 2026-10-04