Astra 模型可靠揪出论文图文不符,早期模型常默认相信作者
soumitrashukla9 · x · 2026-09-06
博主 cremieuxrecueil 称 LLM 审查工具 Astra 让他对用模型检查科学论文错误重拾期待。它能够稳定发现论文正文与代码/数据之间的不一致(text-code discrepancies),而早期模型常忽略这类问题,因为默认相信作者的陈述。
「模型」频道最新
- SimpleBench:前沿模型平均分首次越过人类基线 — Bojackin_Around · 2026-09-06
- 业界人士预言:将出现开源小型化高智能模型的蒸馏流程 — QuixiAI · 2026-09-06
- K2 Horizon 作者:真开源不止权重,数据代码配方全公开 — HongyiWang10 · 2026-09-06
- 网友让 GPT-6 Astra 通宵挂机玩《Unciv》,看醒来前能否通关 — Angaisb_ · 2026-09-06
- M5 Max 本地跑 ds4 约 20 token/s,求最新开源模型推荐 — A_Wild_Entei · 2026-09-06
- 用户反馈 Codex 应用端 Luna Max 消失,网页版仍可用 — Clear_Skye_ · 2026-09-06