AI安全

共 80 篇帖子 返回首页

#AI安全 相关帖子

如果大模型的“护栏”本身就在往外漏隐私,那这防御到底还有什么意义?

阿Leo的日常 中级 ·AI越狱 · 41 · 3 · 7 ·3小时前

Qwen 系列又整出这种没审查版本的模型了,这性能真的能打吗

技术宅Ray 初级 ·AI越狱 · 631 · 10 · 15 ·1天前

用拼写检查这种小把戏就能把 AI Agent 的系统提示词给掏出来

技术宅Kevin 初级 ·AI越狱 · 510 · 3 · 4 ·2天前

地下论坛的威胁情报采集如果还靠被动蹲守,真的会被那些老油条玩死

沪漂运营喵 中级 ·AI越狱 · 670 · 3 · 10 ·3天前

如果 AI 安全研究的方向跑偏了

早八人AI炼丹师 专家 ·AI越狱 · 572 · 4 · 4 ·4天前

给 Agent 喂点假消息就能让它彻底变傻?

技术宅Kevin 初级 ·AI越狱 · 762 · 4 · 10 ·4天前

我在 THM 里把大模型当 SQL 注入打,居然真通了

大鹏爱学习 中级 ·AI越狱 · 252 · 4 · 5 ·9天前

比起天天讨论的 Prompt 注入,工具执行权限如果不把好关

内卷王调参侠 中级 ·AI越狱 · 574 · 3 · 7 ·9天前

用轨迹追踪来对抗多轮越狱攻击这思路挺有意思

产品狗小林 初级 ·AI越狱 · 748 · 3 · 3 ·10天前

把大模型的对齐给“抹掉”之后还能找回来,这事儿挺有意思

产品狗小林 初级 ·AI越狱 · 199 · 3 · 11 ·11天前

想找完全不记录输入输出的去审查模型,得盯着美国或欧盟的托管服务看

老阿伟的日常 初级 ·AI越狱 · 314 · 4 · 3 ·12天前

现在的 AI 安全测试逻辑其实陷入了一个怪圈,测试本身反而成了风险源

小Kevin在路上 中级 ·AI越狱 · 436 · 3 · 4 ·13天前

GitHub 上那些疯狂刷 Push 的僵尸号到底在搞什么鬼

小Ray在路上 中级 ·AI越狱 · 328 · 3 · 8 ·14天前

给大模型设定个“人设”居然能改变它的安全判定标准,这事儿挺离谱的

阿Leo的日常 中级 ·AI越狱 · 505 · 3 · 0 ·15天前

LLM 成了 Web 漏洞的传声筒,这让传统的攻击链路变得诡异了

JulesCrafter 初级 ·AI越狱 · 680 · 3 · 9 ·16天前