所有主流大模型都读不了多调式古希腊语,作者指 RLHF 在系统性摧毁长尾知识

vasilisvj · reddit · 2026-09-02

作者指出:当今所有主流 AI 模型在多调式(polytonic)古希腊语上完全失效——重音混乱、送气符号丢失、用现代希腊语替代古典正字法,导致从亚里士多德全集起的 2400 年哲学文本对「智能」系统不可见。

成因分析:

更一般的论点:每次为「有用性/安全性」微调都在压缩推理空间,任何真实推理偏离普通评估员认知的领域都会受损。这不是语料边角案例,而是「对齐在按设计摧毁知识」的证据。

主张的解法:不是更大的模型,而是不同架构——基于数字化校勘本的 RAG 检索系统、自托管模型、真正检查多调式准确率的评估指标。作者团队正在做此事,并警告:当学科主要文本对下一代研究工具不可读时,经典学这一学科会怎样?

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →