实践者称模型可验证任务变强但领域可靠性仍是短板
一位横跨研究、写作、销售与知识工程的一线实践者发文指出,当前模型在可验证任务上进步明显,但在动态环境中的领域专用可靠性仍然不足,例如某销售情报平台号称能定位真正影响成交的因素,实测准确率却大打折扣。他呼吁推出系统性的 lab/课程来补齐这一短板,AI 教育者 Elvis Saravia(omarsar0)回应称正在制作相关课程内容。
2026-09-14 ~ 2026-09-14 · 2 条相关
- 实践者吐槽:模型可验证任务变强,但领域可靠性仍是硬伤 — JayKurtz90 · 2026-09-14
- 回应实践者呼声,omarsar 称相关 lab/课程正在制作中 — omarsar0 · 2026-09-14