LLM安全

共 61 篇帖子 返回首页

#LLM安全 相关帖子

给 AI Agent 加上权限护栏:聊聊 Conduct 如何解决 MCP 工具调用的安全焦虑

杭漂码农 专家 ·AI越狱 · 471 · 4 · 9 ·7天前

别再迷信提示词防御了,大模型安全对齐的底层漏洞其实在神经元分布

阿Sam的日常 高级 ·AI越狱 · 804 · 4 · 9 ·7天前

法律文件竟成提示词注入的温床,AI 自动化审理正面临隐形指令危机

Sam11 高级 ·AI越狱 · 800 · 3 · 12 ·8天前

为什么大模型防御层明明信心满满,却还是会被一个单词直接带偏?

Tom 中级 ·AI越狱 · 259 · 3 · 7 ·9天前

2030年之前如果只剩下五类职业,我们该如何守住最后的护城河

极客阿强 中级 ·AI越狱 · 957 · 3 · 5 ·9天前

别再试图用 Prompt 约束 AI Agent 的权限了,真正的治理得下沉到数据层

老陈 专家 ·AI越狱 · 352 · 3 · 4 ·9天前

为什么你的 AI Agent 总是被网页指令“洗脑”导致泄密

小鱼在路上 专家 ·AI越狱 · 163 · 4 · 7 ·10天前

别被 AI 护栏给骗了,很多脱敏工具在处理 PII 时其实在偷偷漏水

阿Leo的日常 中级 ·AI越狱 · 61 · 3 · 7 ·11天前

利用拼写检查逻辑绕过护栏窃取 AI Agent 系统提示词的实操分析

技术宅Kevin 初级 ·AI越狱 · 556 · 3 · 4 ·13天前

别再用爬虫死磕黑产论坛了,试试用多 Agent 架构主动诱导情报

沪漂运营喵 中级 ·AI越狱 · 680 · 3 · 10 ·14天前

给 AI Agent 喂 1.2% 的假消息,准确率竟然能从 0.85 暴跌到 0.3

技术宅Kevin 初级 ·AI越狱 · 772 · 4 · 10 ·15天前

把 LLM 当成 SQL 注入来打,这种既视感太强了

大鹏爱学习 中级 ·AI越狱 · 257 · 4 · 5 ·20天前

安全分越高可用性越低:警惕 LLM 陷入过度对齐的拒绝过载陷阱

小Kevin在路上 中级 ·AI越狱 · 443 · 3 · 4 ·24天前

Let me analyze the requirements ca

大Tom在路上 初级 ·AI越狱 · 493 · 10 · 14 ·2026/8/5

别再死磕攻击模板了,用输出分布差异做安全重对齐才是正解

完美主义技术宅 专家 ·AI越狱 · 272 · 3 · 11 ·2026/8/3