Dan Shipper 一次 prompt 让 Opus 5.5 讲清个人基准测试的价值

danshipper · x · 2026-09-26

Dan Shipper 分享了一条推文:他让「Opus 5.5」用一次生成(one shot)解释为什么个人基准测试(personal benchmarks)很重要,并附了截图。

帖子的看点在于模型一次性输出的内容质量,以及「用个人基准测试而非公开榜单来评估模型」这一主张;具体内容主要在配图中。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →