论文盘点 229 个开源 ULLM 应用,标出 14 个恶意方向
BlancheMinerva · x · 2026-07-28
- 这条讨论围绕一篇关于 ULLM 应用 的论文展开,争议点在于作者是否把一些合法但令人反感的用途过度标成“malicious”。
- 配图摘要显示,这项研究只在两位标注者达成一致时才计入案例,且一致性达到 Cohen’s κ = 0.91。
- 研究最终整理出 229 个开源 ULLM 应用,分成 12 类功能,包括无审查聊天、文档处理、语音助手、医疗建议等。
- 其中有 14 个被判定为面向恶意服务的应用,包含 3 个 NSFW 故事生成 和 11 个 NSFW 角色扮演 工具,文中还点名了 “HitlerGPT”。
- 回复者认为,这些案例并不是犯罪活动,而是作者不喜欢的合法用途。
所属事件:盘点229个未审查大模型应用引发安全边界争议(7 条相关)→
「安全」频道最新
- 「末日论是监管护城河」:开源阵营反击限制开放权重模型呼声 — AlexTensor · 2026-09-23
- 观点:AI 安全可循工程学科老路——简单情形形式化证明,复杂情形实证评估 — burny_tech · 2026-09-23
- 《随机鹦鹉》作者发声:反对「暂停 AI」信,呼吁聚焦当下真实危害 — marigo · 2026-09-23
- 「这是种酷刑」:开发者讽刺厂商把网络攻击测试包装成安全研究 — ctjlewis · 2026-09-23
- Okta 推出 Human Principal,为 AI 代理绑定真实人类身份 — BecauseCulture · 2026-09-23
- GPT-6 Sol Codex 系统提示词泄露,全文超 29.4 万字符 — gaganghotra_ · 2026-09-23