AI 评测可借鉴社会科学定性研究方法
emollick · x · 2026-08-17
Ethan Mollick 指出,社会科学在过去一个世纪中积累了解决非可验证领域评测的方法,AI 领域不必从零开始。对于写作、创意等难以量化的领域,人类主观意见是现实中的基准,AI 从业者应参考定性研究方法论来进行测量与评测。
所属事件:AI 非可验证任务评测可借鉴社会科学定性研究(2 条相关)→
「模型」频道最新
- 单卡 5090 跑出每秒 206 token,Qwen3.8-27B 性能实测 — StefanoGogioso · 2026-08-17
- antirez优化DwarfStar:Station上170 t/s生成,22k tokens/s预填充 — antirez · 2026-08-17
- OpenAI 推出分级访问制,发布安全模型 GPT-5.6-Cyber — dl_weekly · 2026-08-17
- 阿里云 DeepSeek 模型价格仍具竞争力 — tobowers · 2026-08-17
- Claude 拟人化时刻:不仅拒绝还开始评价用户 — ctjlewis · 2026-08-17
- Qwen3.8 实测:MTP 参数影响吞吐,Q4 精度胜过 Q8 — New-Inspection7034 · 2026-08-17