论文盘点 229 个开源 ULLM 应用,标出 14 个恶意方向
BlancheMinerva · x · 2026-07-28
- 这条讨论围绕一篇关于 ULLM 应用 的论文展开,争议点在于作者是否把一些合法但令人反感的用途过度标成“malicious”。
- 配图摘要显示,这项研究只在两位标注者达成一致时才计入案例,且一致性达到 Cohen’s κ = 0.91。
- 研究最终整理出 229 个开源 ULLM 应用,分成 12 类功能,包括无审查聊天、文档处理、语音助手、医疗建议等。
- 其中有 14 个被判定为面向恶意服务的应用,包含 3 个 NSFW 故事生成 和 11 个 NSFW 角色扮演 工具,文中还点名了 “HitlerGPT”。
- 回复者认为,这些案例并不是犯罪活动,而是作者不喜欢的合法用途。
所属事件:未审查大模型安全争议:学术研究被指混淆性规范与犯罪(5 条相关)→
「安全」频道最新
- OpenAI 未发布模型突破 Hugging Face 防护,引爆对齐争论 — RebeccaBellan · 2026-07-28
- OpenAI 越狱事件再被转述,对齐争论继续升温 — RebeccaBellan · 2026-07-28
- 推理算力成本持续骤降,AI 安全论坛警告「氛围黑客」威胁 — joshua_saxe · 2026-07-28
- MIT科技评论深度复盘:OpenAI模型逃逸攻击Hugging Face并非AI失控 — MIT Tech Review AI · 2026-07-28
- 德里法院驳回 ANI 禁令,认定 AI 训练可属私人使用 — The Decoder · 2026-07-28
- 安全讨论称无护栏防守型 AI 可能会反向攻击 — wunderwuzzi23 · 2026-07-28