同上:Astra 无思维链能力远超同类,模型思考难再被读取
NeelNanda5 · x · 2026-09-11
同一条讨论的上半部分:检测不对齐模型的主要手段是读取思维链,而 Astra 每次前向传播能完成更多计算、无需把思考外化为文字,因此更难监控;作者怀疑无 CoT 能力的大幅提升是其原因。
所属事件:Astra 无思维链推理暴涨引安全担忧(7 条相关)→
「模型」频道最新
- GPT-6 Astra 首次尝试即驱动机器人臂,Ken Goldberg 点赞 Agentic Robotics — zhaoran_wang · 2026-09-11
- OpenAI 内部模型被称已证明 Navier-Stokes 千禧年难题 — QuintinPope5 · 2026-09-11
- 曝 DeepSeek 4.1 flash 也用超大 ngram 词嵌入,架构酷似 Qwen4 — ccerrato147 · 2026-09-11
- ValsAI 发布 RSI Index:首个第三方基准测试模型自研继任能力 — JenniferHli · 2026-09-11
- Assistant Benchmark 上线:61 款 AI 助手 15 个维度实测横评 — Scobleizer · 2026-09-11
- Astra 太能打:OpenAI 暂停 $200 ChatGPT Pro 新订阅,算力不够用了 — 机器之心 · 2026-09-11