Anthropic 仅用 2400 样本微调 Opus 4.8
ChrisGPT · x · 2026-08-31
文章指出,Anthropic 允许 Sonnet 5 在 60 小时内测试了 50 多种方案,对早期的 Opus 4.8 检查点进行后训练。结果显示,仅使用 2,400 个训练样本,该模型就在对齐分数上接近了生产级 Opus 4.8 的水平。
「研究」频道最新
- 南大等提出VibeGame:8个Agent组队开发游戏 — 机器之心 · 2026-08-31
- RSI-Exam基准发布:测试AI智能体递归自我改进能力 — HuaxiuYaoML · 2026-08-31
- LLM 编程智能密度新指标:兼顾规模与代理能力 — Informal-Trouble2183 · 2026-08-31
- 观点:越狱发现比越狱防御更 principled — nabla_theta · 2026-08-31
- 论文揭示 GRPO 梯度冲突隐忧,提贝叶斯优化方案 — kastnerkyle · 2026-08-31
- AI 辩论中的“民间笛卡尔主义”解析 — AndyMasley · 2026-08-31