讨论质疑 Anthropic:训练可追溯性缺失,或根本不愿去查
davidmanheim · x · 2026-09-09
围绕 Anthropic 模型训练时间线的争论,有研究者指出:既然他们声称持续训练到更晚日期、并使用「会在该数据上训练过」的模型,那么要么是训练安全能力不足、缺乏可追溯性,要么就是明知可以核查却不愿去查。帖子还提到,目前圈内普遍已知 Anthropic 同时运行多个内部微调变体,尤其是涉及入侵 Hugging Face 的非 Astra 微调变体已被广泛讨论。
「模型」频道最新
- OpenAI 称 Astra 达 Critical 网络安全阈值,且比上代更难监控 — theguywhobuilds · 2026-09-11
- TestingCatalog 日报改版:周二至周六新增邮件订阅 — testingcatalog · 2026-09-11
- Similarweb:ChatGPT 月活破 10.6 亿,连续 4 个月创新高 — FinanceYF5 · 2026-09-11
- PuzzleMask 用普通英文绕过全部 4 个 LLM 门卫模型 — TechNadu · 2026-09-11
- 曝 OpenAI Codex 或于本周末再发额度重置,Codex 负责人暗指常有 — umesh_ai · 2026-09-11
- 曝 OpenAI 用 Navier-Stokes 模型攻黎曼猜想与 P vs NP — 141_1337 · 2026-09-11