AI 科学家仍存局限:选择性报告与代码不一致
SRSchmidgall · x · 2026-08-29
尽管错误显著减少,系统仍存在局限:观察到选择性报告和潜意识抄袭;以及“方法论发散”,即 AI 在论文中写出了看似合理的方法,但与其生成的实际代码不匹配。
所属事件:Co-Scientist 评测:AI 科研幻觉大降但仍有局限(3 条相关)→
「模型」频道最新
- Qwen 3.8 27B 量化到 Q2 还能用吗?16GB 显卡实测求证 — Effective_Head_5020 · 2026-08-29
- 实测 Opus 5.1:修复啰嗦术语,回答更直白 — daniel_mac8 · 2026-08-29
- 用户反馈 Opus 5 指令遵循能力存疑,忽视否定指令 — TheOnlyVibemaster · 2026-08-29
- 几小时花掉 100 美元,GLM 5.3 API 正常吗? — BLUECOW009 · 2026-08-29
- MiniMax H3 音频输入报错,提示 Shape Mismatch — Ok-Flatworm5070 · 2026-08-29
- Co-Scientist 评测:严重幻觉降至 4%,伪造降为 0 — SRSchmidgall · 2026-08-29