新论文:在预训练阶段注入合成道德反思,3B模型价值观显著改变
sethlazar · x · 2026-08-14
Synthetic Persona Pretraining 论文正式发布,提出在预训练文档中注入10%的合成道德反思,训练至3B参数模型。实验表明,早期干预能显著改变模型的价值优先级。
「研究」频道最新
- AutoDesign:将智能体框架纳入优化循环,论文生成海报超越Claude Design — dair_ai · 2026-08-15
- Qwen3.8-27B与3.6架构完全相同,能力提升全靠训练改进 — Course_Latter · 2026-08-15
- Notion 发布真实工作负载评测:开源模型质量达 94-98%,成本低至 0.02 美元 — ivanhzhao · 2026-08-15
- MLA+MTP或非良配:从算术强度看注意力机制优化 — tokenbender · 2026-08-14
- Notion 发布真实工作负载评测:开源模型质量达 94-98%,成本低至 0.02 美元 — ivanhzhao · 2026-08-14
- OpenRouter推出Web搜索基准测试,涵盖多模型与配置排名 — AravSrinivas · 2026-08-14