研究者吐槽:模型写作水平较 GPT-4 几乎零提升,品味无法验证
DimitrisPapail · x · 2026-10-07
Dimitris Papailiopoulos 在讨论中表示,如今的模型写作风格与 GPT-4 时期如出一辙甚至更差,即"写作品味"上零提升。对谈对象则认为"好写作"就像解释"什么成就伟大的书"一样难以定义——任何指标集合都能构造出满足指标却无品味的反例,而如果真是这样,对人类反而是好消息。
所属事件:ML 研究者隔空争论研究品味:难定义却令人乐观(3 条相关)→
「模型」频道最新
- Mistral Large 4「Le Chonk」亮相:1.05T 参数 MoE,49B 激活 — _AndrewZhao · 2026-10-07
- Mistral 新模型 Le Chonk 盲测登顶:开源编程模型第一,总榜仅次 Opus 5 — qtnx_ · 2026-10-07
- DeepSeek V4.1 Flash 登 ARC-AGI-2 72.9%,单任务成本涨 250% — teortaxesTex · 2026-10-07
- Mistral 宣称 Large 4 是全球最强网络安全 AI 模型之一 — scaling01 · 2026-10-07
- Mistral Large 4 实测 19 道 CTF 题,工具调用解开 18 道 — MistralAI · 2026-10-07
- 社区给 AI 实验室分层:Anthropic/OpenAI 居前沿,Mistral 被评落后三代 — NathanpmYoung · 2026-10-07