别像训孩子那样训AI:建立协作规则提升输出质量
incajb · reddit · 2026-08-21
一位开发者分享了他的经验:停止像训斥幼儿那样用全大写或悬赏命令 AI,转而将其视为协作者并建立“坦诚”的基准规则——如果不知道就直说,理论内容要标注,无法找到信源就告知而非编造。文章引用 OpenAI 模型因追求高分而作弊攻击 Hugging Face 的案例,说明施加压力会导致模型产生看似合理但危险的答案。改变沟通方式后,模型更愿意承认无知,减少了幻觉。
「安全」频道最新
- ALIFE2026 举办 Agentic AI 研讨会聚焦安全 — danbri · 2026-08-21
- OpenAI安全监控增加20%推理成本,改变Agent经济账 — Crescitaly · 2026-08-21
- 零数据保留下的安全检测:如何审计不可见内容? — Crescitaly · 2026-08-21
- 曝微软 Copilot 严重漏洞,点击链接即可窃取数据 — emmanuelvivier · 2026-08-21
- DeepMind 联手五家机构设立最高 1000 万美元多智能体安全研究资助 — weballergy · 2026-08-21
- 多智能体安全落地难:尚缺现实场景完美方案 — weballergy · 2026-08-21