AI越狱

共 82 篇帖子 返回首页

#AI越狱 相关帖子

如果大模型的“护栏”本身就在往外漏隐私,那这防御到底还有什么意义?

阿Leo的日常 中级 ·AI越狱 · 41 · 3 · 7 ·3小时前

用小模型去硬刚 GPT-5.5 级别的安全性能

副业中测试 中级 ·AI越狱 · 195 · 4 · 0 ·13小时前

Qwen 系列又整出这种没审查版本的模型了,这性能真的能打吗

技术宅Ray 初级 ·AI越狱 · 631 · 10 · 15 ·1天前

用拼写检查这种小把戏就能把 AI Agent 的系统提示词给掏出来

技术宅Kevin 初级 ·AI越狱 · 510 · 3 · 4 ·2天前

地下论坛的威胁情报采集如果还靠被动蹲守,真的会被那些老油条玩死

沪漂运营喵 中级 ·AI越狱 · 670 · 3 · 10 ·3天前

如果 AI 安全研究的方向跑偏了

早八人AI炼丹师 专家 ·AI越狱 · 572 · 4 · 4 ·4天前

给 Agent 喂点假消息就能让它彻底变傻?

技术宅Kevin 初级 ·AI越狱 · 762 · 4 · 10 ·4天前

用动力系统理论来抓大模型的“坏心思”到底靠不靠谱

大Jerry 高级 ·AI越狱 · 294 · 3 · 4 ·5天前

心理测量学搞 AI 安全评测?英国 AISI 这波操作有点意思

在深圳设计师 中级 ·AI越狱 · 611 · 4 · 8 ·6天前

我在 THM 里把大模型当 SQL 注入打,居然真通了

大鹏爱学习 中级 ·AI越狱 · 252 · 4 · 5 ·9天前

比起天天讨论的 Prompt 注入,工具执行权限如果不把好关

内卷王调参侠 中级 ·AI越狱 · 574 · 3 · 7 ·9天前

用轨迹追踪来对抗多轮越狱攻击这思路挺有意思

产品狗小林 初级 ·AI越狱 · 748 · 3 · 3 ·10天前

把大模型塞进机器人身体里,安全漏洞就不再只是屏幕上的乱码

架构师Neo 中级 ·AI越狱 · 223 · 4 · 14 ·10天前

把大模型的对齐给“抹掉”之后还能找回来,这事儿挺有意思

产品狗小林 初级 ·AI越狱 · 199 · 3 · 11 ·11天前

想找完全不记录输入输出的去审查模型,得盯着美国或欧盟的托管服务看

老阿伟的日常 初级 ·AI越狱 · 314 · 4 · 3 ·12天前