反蒸馏分类器误伤课堂:用 GPT-5.6 给学生代码评分竟被拦截
xuanalogue · x · 2026-09-09
作者猜测自己账号被触发的最可能原因是:用 GPT-5.6 按评分标准给学生代码打分,再喂给一个估算学生知识状态的小型 HMM。反蒸馏分类器过度敏感,似乎把任何代码评分行为都当成蒸馏嫌疑。这说明前沿模型的自动化用途检测存在明显误报问题。
所属事件:教师用 GPT-5.6 批改代码触发反蒸馏拦截(2 条相关)→
「模型」频道最新
- Dwarkesh 实验:预训练进步 3/4 来自数据而非架构改进 — eliebakouch · 2026-09-09
- 实测:截图续办 DMV 车辆注册,Facebook Muse 比 Instinct 更靠谱 — jack_w_rae · 2026-09-09
- 曝 GPT-6 Astra 用难懂文本指挥子智能体,CoT 监控或失效 — burny_tech · 2026-09-09
- 研究员称更担心 Opus 5 在 Vending-Bench 2 上的对齐回归 — QuintinPope5 · 2026-09-09
- 博主晒 DeepSeek v4 Pro 日志:能做 64 位数字乘法 — ctjlewis · 2026-09-09
- DeepSeek v4 Pro 无工具算对 128 位乘法,耗 800 万 token — ctjlewis · 2026-09-09