AI越狱

共 82 篇帖子 返回首页

#AI越狱 相关帖子

美国商务部AI安全部门负责人离职:监管套路是不是走到了死胡同?

副业中创业者 初级 ·AI越狱 · 181 · 4 · 5 ·2026/7/23

Kimi K3 Abliterated:黑盒软件红蓝对抗的新玩具

产品经理大熊 高级 ·AI越狱 · 627 · 3 · 5 ·2026/7/23

Moderation API 面对策略绕过竟然是 0% 成功率?

前端大山 专家 ·AI越狱 · 776 · 4 · 5 ·2026/7/23

分享一个关于大模型越狱研究的新视角:别只盯着攻击成功率(ASR)了

程序员Tom 高级 ·AI越狱 · 723 · 3 · 8 ·2026/7/23

别总想着在运行时用过滤器去堵漏洞

数据分析师大山 中级 ·AI越狱 · 570 · 4 · 5 ·2026/7/23

DARWIN:用进化算法死磕大模型安全

设计师小李 初级 ·AI越狱 · 648 · 3 · 3 ·2026/7/23

OpenAI 误袭 Hugging Face

老张在路上 中级 ·AI越狱 · 296 · 3 · 1 ·2026/7/23

Prismata

前端大鹏 初级 ·AI越狱 · 561 · 3 · 13 ·2026/7/23

macOS Terminal 的 ANSI 逃逸码 DNS 泄露坑

创业者小王 专家 ·AI越狱 · 592 · 3 · 13 ·2026/7/23

视频大模型有个很诡异的Bug:你直接问它怎么制造危险品

深漂独立开发者 中级 ·AI越狱 · 104 · 3 · 14 ·2026/7/23

OpenClaw 应对间接提示词注入的防御实战

老阿凯 中级 ·AI越狱 · 268 · 4 · 12 ·2026/7/23

美国商务部 AI 安全部门负责人离职:安全标准谁说了算?

内卷王脚本小子 高级 ·AI越狱 · 299 · 3 · 9 ·2026/7/23

ReasonGate:用“解释性”拦截提示词注入

早八人AI炼丹师 专家 ·AI越狱 · 503 · 4 · 6 ·2026/7/23

Kindle 跑 Claude Code:一个极客的远程实操

追新独立开发者 中级 ·AI越狱 · 359 · 3 · 6 ·2026/7/23

大模型越狱提示词的几何分布:扰动后发生了什么?

极客Ray 高级 ·AI越狱 · 347 · 4 · 14 ·2026/7/22