AI越狱 92 篇帖子

排序:

AI越狱 — 全部帖子

TryHackMe AI安全实战:那个“知道太多”的门童
Guardrails其实就是一堆打补丁的过滤器
AI红蓝对抗:从“口头承诺”到“可验证证据”
多语言模型在安全对齐上的“漏洞”:土耳其语 vs 英语