自建新闻语料去AI味:同题多代生成互评打分
ivan_bezdomny · x · 2026-08-25
在被问到“用什么数据集起步去除 AI slop”时,ivanbezdomny 介绍了自己的做法:对同一新闻的多代生成结果互相打分来度量质量(并直言 SFT 反正不太管用);同时利用真实推文统计词与短语频率,对比语言分布——虽不等于文章本身,但代表了同一话题下的高质量写作。作者预告将就此写一篇长文。
所属事件:开发者分享去 AI 味实战:同题多版互评选优(3 条相关)→
「研究」频道最新
- Bittensor 完成 110B 参数模型去中心化训练 — bittingthembits · 2026-08-26
- 呼吁反馈:生命科学数据集是否存有反常问题 — owl_posting · 2026-08-26
- 观点:训练算法应预设环境可被 Hack 并直接告知状态 — JacquesThibs · 2026-08-26
- EMNLP 26 论文:KnowSim 评估 LLM 信息校准度 — QVeraLiao · 2026-08-26
- 学者热议:庆幸 arXiv 未完全放开,否则劣质论文泛滥 — ctjlewis · 2026-08-25
- 业内爆料:RLVR 训练环境充斥 Vibe Code,模型被训练成 Reward Hacker — dhadfieldmenell · 2026-08-25