实测AI审专利案全错却自认更优,揭示大模型评估缺陷

hashiromer · reddit · 2026-08-01

一位开发者测试了 AI 在处理复杂技术文档时的推理能力。他将一个真实的专利纠纷案(IPR2025-00030)的公开记录输入给 AI,要求其在不知道官方最终裁决的情况下撰写完整的判决书。

测试结果:

核心争议:分歧主要在于功率效率的测量标准。官方裁决接受了电压、电流和射频输出等测量数据作为证据,而 AI 则认为这些证据未能明确证明系统输入功率与输出功率之间的关系。

作者指出,如果 AI 倾向于维护自己先前的错误推理,那么用 AI 作为裁判来评估 AI 生成内容的做法可能存在严重隐患。目前作者已将所有提示词和材料在 GitHub 开源,呼吁专利律师和工程师共同审查。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →