LLM安全

共 61 篇帖子 返回首页

#LLM安全 相关帖子

去掉安全限制后 AI 竟然变得更乐观了?聊聊去审查模型的副作用

咖啡续命折腾党 中级 ·AI越狱 · 221 · 4 · 2 ·2026/8/2

给机器人装上世界模型后,物理世界的安全漏洞被放大了多少

增长黑客Lucy 初级 ·AI越狱 · 495 · 4 · 12 ·2026/8/1

AI 发现的漏洞真的能实战吗?深度解析 1% 的漏洞利用率

追新独立开发者 中级 ·AI越狱 · 255 · 3 · 1 ·2026/7/30

如何防止多智能体系统被恶意任务碎片化攻击:聊聊 SafeFlow 的语义染色机制

Sam11 高级 ·AI越狱 · 308 · 3 · 0 ·2026/7/29

Inspect India Evals

开源爱好者小雨 专家 ·AI越狱 · 752 · 3 · 15 ·2026/7/29

别被所谓的安全防御给坑了,聊聊 LLM 越狱防御带来的性能损耗

躺平产品经理 初级 ·AI越狱 · 641 · 3 · 6 ·2026/7/28

用 Prompt Injection 暴力破解 TryHackMe 门童关卡的实战心得

大鹏的日常 初级 ·AI越狱 · 333 · 3 · 12 ·2026/7/28

别在碎片化教程里打转了,用这套官方免费教材构建 AI 知识体系

Quinn20 专家 ·AI越狱 · 786 · 3 · 7 ·2026/7/27

别把 AI 安全护栏当成防火墙,它本质上就是一堆打补丁的过滤器

杭漂架构师 中级 ·AI越狱 · 278 · 4 · 13 ·2026/7/26

别再用“已做安全测试”这种模糊话术去糊弄 B 端客户的 AI 审计了

小阿伟的日常 初级 ·AI越狱 · 179 · 4 · 7 ·2026/7/26

别再死磕 AI 安全理论了,分享几个在 Agent 实战中容易被忽视的攻击面

大Tom在路上 初级 ·AI越狱 · 267 · 3 · 2 ·2026/7/26

模型规模越大越容易被提示词“破限”这件事非常有意思

小Kevin在路上 中级 ·AI越狱 · 730 · 3 · 8 ·2026/7/26

别再死磕 Prompt 优化了,试试用诱饵字体给视觉大模型设陷阱

独立开发者Leo 专家 ·AI越狱 · 560 · 3 · 11 ·2026/7/26

用土耳其语绕过 Qwen2.5-7B 的对齐限制:低资源语言的“服从度非对称性”实测

内卷王调参侠 中级 ·AI越狱 · 383 · 3 · 3 ·2026/7/25

Opus 5 配合 Auto Mode 真的能把浏览器提示词注入率压到 0% 吗

老陈 专家 ·AI越狱 · 838 · 3 · 13 ·2026/7/25