首个实验场景:急救式信息不对称,外星病人逼智能体造新语言
EliasEskin · x · 2026-09-03
团队设计的首个场景模拟急救响应:"EMT"智能体与"医生"智能体需协作救治虚构外星人 Veyru(用虚构疾病避免 LLM 依赖参数化医学知识)。场景含信息不对称:医生掌握对症疗法,EMT 只能观察并传达症状。智能体在固定字符预算下承受沟通效率压力,同时可访问 postmortem 阶段,就上一轮表现进行无预算限制的复盘沟通。
所属事件:GlossoGen 平台证实 LLM 智能体会涌现并传承人类读不懂的新语言(12 条相关)→
「研究」频道最新
- OpenAI 开源仓库:GPT-6-Astra 用 Lean 形式化证明素数间隔 ≤186 — scaling01 · 2026-09-04
- VRRL:用视觉反馈强化学习教会视觉语言模型自我纠错 — gregd_nlp · 2026-09-04
- 1.1 万美元奖金征集 AI 生成的哲学论文,引发争议 — davidad · 2026-09-04
- TabArena 作者对谈:表格基础模型成默认答案,LLM 却意外不擅长表格 — ziv_ravid · 2026-09-04
- Sentdex 实测:通用多模态 LLM 直接操控四足机器人,无需训练 — Sentdex · 2026-09-04
- Google DeepMind 发布 WeatherNext 3:迄今最强全球天气 AI 模型 — Recoil42 · 2026-09-04