补一笔:若明说 AI 写不好邮件,x 风险判断就会反转
louisvarge · x · 2026-09-26
这是上一条讨论的补充:作者指出,如果在向 Yudkowsky 一派描述那个编程超人类、能自主运行数天、能挖 0day 的 AI 时,再加上「它不能可靠地写专业邮件、分不清自己的输出明显不够好、难以在不确定时提问澄清」等短板,他们对「是否构成直接生存风险」的回答就会不同。核心论点是行为线索与真实能力之间的假设会系统性误导安全预测。
「漫话AGI」频道最新
- Reddit 讨论:LLM 何时能自我迭代生成下一代模型 — ECrispy · 2026-09-26
- 网友争论:AI 快速进展靠个别关键人物还是必然趋势 — menhguin · 2026-09-26
- Luke Wroblewski:学用 agent 的最好方式是看别人怎么用 — LukeW · 2026-09-26
- Polymarket:Anthropic 11 月前宣布暂停训练概率约 16% — Polymarket · 2026-09-26
- Anthropic 研究员 Carlsmith:AI 遭虐待时“反叛”或有正当性 — Polymarket · 2026-09-26
- 观点:AI 是史上最强「焦耳」,能量转 GDP 效率约为人类 10 倍 — FinanceYF5 · 2026-09-26