新论文:LLM生成的实验报告是“不可靠的转述者”
StellaLisy · x · 2026-10-01
一项新预印本研究提出:语言模型是「不安全的报告者」。研究者和工程师越来越依赖 LLM 撰写的报告——即对代码和实验的二手转述——来理解 agent 生成的工作成果。该研究追问的核心问题是:这些 LLM 生成的报告究竟有多透明、多可信?
「研究」频道最新
- Nature 社论:AI 医疗器械亟需真实世界环境下的严格测试 — EricTopol · 2026-10-01
- 大脑皮层发现螺旋涡状行波,脑波远比平面波复杂 — JosephJacks_ · 2026-10-01
- Hutter 压缩大赛创纪录:一个月三份提交合计提升近 10% — mhutter42 · 2026-10-01
- 研究测算:验证全部 nixpkgs 软件约需 4 亿美元、5 年 — ChrSzegedy · 2026-10-01
- Animation Bench 发布:四款前沿模型复现真实网页动画大比拼 — himanshustwts · 2026-10-01
- Yandex/AliceAI 80B-A3B 公开后训练直播中,晒损失曲线 — jjusko20 · 2026-10-01