模型行为来源排查指南:从训练数据到推理的全链路
gerardsans · x · 2026-08-20
Gerard Sans 在回复中提供了一个排查模型特定行为来源的分步指南,按可能性高低排序:1. 训练数据;2. 预训练;3. 后训练(RLHF/RL);4. 部署(系统提示词、UX/UI、API 设置);5. 推理(提示词、上下文、工具)。他还提醒不要混淆为了融资的实验室叙事与实际科学。
「编程与Agent」频道最新
- 开发者用 React Native 和 WebGPU 复刻经典 iBeer 应用 — JoshuaJBouw · 2026-08-20
- Together AI 发布 Hallmark:拒绝 AI 味的设计 Skill — dotey · 2026-08-20
- Google 工程师拆解 Agent:只是循环里的 LLM 与现实落差 — bigdata · 2026-08-20
- OpenAI 自动化 12 项浏览器任务:从结账到表单填写 — gdb · 2026-08-20
- Instinct、Grok Bots 与 ChatGPT Work 深度对比评测 — illscience · 2026-08-20
- OpenCLIP 新增 MaMMUT 支持:修复 pooling 并推出 MaMMUT2 — wightmanr · 2026-08-20