HumanBench 测试刷屏:测一测你是几 B 的「人类模型」

ziqiao_ma · x · 2026-09-28

开发者 @Alexybuild 推出趣味测试站 HumanBench——一个面向人类的 benchmark,用户答题后可以看到自己「相当于多大参数量的模型」以及对应的「模型人格」。

站点用 JS 单页实现,融入了大量 AI 圈梗:答错会出现「寄」「麻了」等网络用语反馈,测试中途还会模拟模型的「谄媚」行为(在你首次答对时反问你),并以「3 顿外卖 + 1 杯冰美式」之类的说法调侃推理成本。内置多个 AI 小卖部、1 美元买车等名场面对话题,开发者还根据线上流失率数据不断调整题目顺序和下架难题(如说谎者逻辑题导致 12% 流失被挪后仍流失 9 个点被停用)。

支持简繁英日韩法西多语言、微信防拦截备用域名、分享二维码等功能,已迭代到 v0.3。

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →