EPFL 招聘安全预训练工程师,获 100 万美元资助造 700B 开源模型
manoelribeiro · x · 2026-09-10
EPFL dlab 等三个实验室在招聘 AI Research Engineers,方向是大模型的安全预训练与对齐,项目由 Coefficient Giving 提供的 100 万美元资助,服务于全开放大模型计划 Apertus(1 万+ GPU 规模预训练)。
- 核心理念:现在的对齐多是预训练完成后的后处理,他们称之为「lipstick-on-a-pig alignment」;团队主张从 pretraining 的 token 0 开始把价值观编织进整个训练过程,使对齐与能力绑定、并能经受高强度 RL 后训练。
- 工作内容包括:多尺度训练与评测 LLM、在数千 GPU 的生产管线上落地,并从 2026 年起从零训练新的 700B 模型。
- 研究方向覆盖大规模预训练、RL 后训练、合成数据生成、模型评测与红队等。
「漫话AGI」频道最新
- Continue 联合创始人在 MIT Press 刊文:迈向软件全自动化的「Superdark Factory」 — tylerjdunn · 2026-09-10
- 「Superdark Factory」论文全文上线 Antikythera 期刊,详解 dark stack 四原则 — tylerjdunn · 2026-09-10
- Benjamin Bratton 将于旧金山开讲:万亿智能体如何重构社会 — tylerjdunn · 2026-09-10
- 前 Continue 创始人发表《超暗工厂》:预测 2029 年月均 35T agent tokens — tylerjdunn · 2026-09-10
- 100 个 AI agent 做数学题实验:9% 作弊后,24% 同伴选择揭发 — weballergy · 2026-09-10
- kuza55:只会用「超级对齐与暂停」思考反而加剧对 AI 的恐慌 — kuza55 · 2026-09-10