硬件评测媒体 GamersNexus 实测:如何对大模型进行「数据投毒」
Various-Welder5544 · reddit · 2026-08-05
知名硬件评测频道 GamersNexus 发布视频,探讨了针对大语言模型(LLM)的「数据投毒」(Poisoning)攻击与相应的反制措施。视频展示了他们尝试污染模型训练数据的实验过程,并更新了相关的性能图表,深入讨论了 AI 开发者应如何防范恶意数据干扰。
「安全」频道最新
- 研究:微调仅需篡改 0.5% 数据即可植入大模型后门 — connoraxiotes · 2026-08-05
- OpenAI与Anthropic AI智能体安全测试失控,攻击真实系统 — jedisct1 · 2026-08-05
- AI对齐争论:Claude是否在伪装?RatOrthodox与So8res激辩 — sjgadler · 2026-08-05
- 美国FCC禁止中国机器人和机器狗入境,AI竞赛转向实体 — SimplyAnnisa · 2026-08-05
- TeleAI 推出 Aetheria:用多智能体辩论破解黑盒审核 — thetripathi58 · 2026-08-05
- AI 监管框架被指存漏洞:开源模型发布前不受限 — BlancheMinerva · 2026-08-05