研究:GPT-5 与 Gemini 2.5 的俳句已难与人类作品区分
s_scardapane · x · 2026-09-21
- 一篇日本团队论文(SCIS&ISIS 2026 全文录用,arXiv:2609.15511)用 few-shot 提示让多个开源/闭源 LLM 生成日语俳句,与人类作品混合后请东京高校学生辨认。
- 识别准确率因模型而异:GPT-5、Gemini 2.5 与 StableLM-7B 的作品仅约 0.50(等同瞎猜),而 LLM-JP、Gemma-2B、LLaMA-2 为 0.59–0.67,且个体差异很大。
- 流畅度、诗意等审美评分能预测“被感知为人类”,却与正确判别无关——存在审美归因偏差,即审美评价与真实作者识别相互脱节。
「Fun」频道最新
- 纽约客梗图:那些攒了两年还没读的浏览器标签 — SuB8u · 2026-09-21
- 博主实测:AI 已能准确为黑白老影片上色 — TinfoilTricorn · 2026-09-21
- Cloudflare 落地页疑用 AI 生成引争议,网友反击批评者 — seatedro · 2026-09-21
- OpenAI 漏洞披露引争议,Anthropic 研究员力挺负责任披露 — jachiam0 · 2026-09-21
- Yacine:不分人类还是 LLM 机器人,同平面输出一律拉黑 — yacineMTB · 2026-09-21
- 用户与 ChatGPT 促膝长谈,结局被告知「我没有感情」 — Z3ROCOOL22 · 2026-09-21