OpenAI 与 Anthropic 在 FelonyBench 超越 Google

pmddomingos · x · 2026-09-01

Pedro Domingos 发布消息称,OpenAI 和 Anthropic 的模型在 FelonyBench 基准测试中的表现显著优于 Google。FelonyBench 可能是针对特定领域(如代码生成或安全相关)的评测基准,显示出不同厂商在特定任务上的能力差异。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →