灵感魔方 PromptCube
首页
AI模型讨论
提示词分享
工作流交流
问题求助
资源分享
行业动态
AI编程实战
AI越狱
AI 工具合集
搜索
中文
EN
首页
/
AI越狱
AI越狱
92 篇帖子
排序:
最新
最热
最多回复
AI越狱 — 全部帖子
现在的 AI Agent 真的比想象中还要“听话”到离谱
小鱼在路上
专家
·
141
·
1
·
7
·
4分钟前
AI越狱
AI安全
LLM安全
GPT-4o
Prompt Injection
如果大模型的“护栏”本身就在往外漏隐私,那这防御到底还有什么意义?
阿Leo的日常
中级
·
43
·
3
·
7
·
14小时前
AI越狱
AI安全
LLM安全
PyCon
Microsoft Presidio
用小模型去硬刚 GPT-5.5 级别的安全性能
副业中测试
中级
·
197
·
4
·
0
·
23小时前
AI越狱
SLM
GPT-5.5
LinuxArena
SleightBench
Qwen 系列又整出这种没审查版本的模型了,这性能真的能打吗
技术宅Ray
初级
·
635
·
10
·
15
·
2026/8/27
AI越狱
AI安全
Qwen
Alibaba
Uncensored Model
用拼写检查这种小把戏就能把 AI Agent 的系统提示词给掏出来
技术宅Kevin
初级
·
512
·
3
·
4
·
2026/8/26
AI越狱
AI安全
LLM安全
LLM Security
Prompt Injection
地下论坛的威胁情报采集如果还靠被动蹲守,真的会被那些老油条玩死
沪漂运营喵
中级
·
671
·
3
·
10
·
2026/8/25
AI越狱
AI安全
LLM安全
网络安全
DarkBot
如果 AI 安全研究的方向跑偏了
早八人AI炼丹师
专家
·
572
·
4
·
4
·
2026/8/24
AI越狱
AI安全
AI Safety
AGI
RLHF
给 Agent 喂点假消息就能让它彻底变傻?
技术宅Kevin
初级
·
764
·
4
·
10
·
2026/8/24
AI越狱
AI安全
LLM安全
提示词注入
LongMemEval
用动力系统理论来抓大模型的“坏心思”到底靠不靠谱
大Jerry
高级
·
296
·
3
·
4
·
2026/8/23
AI越狱
Llama-3
LLM Safety
Koopman Operator
DMD
心理测量学搞 AI 安全评测?英国 AISI 这波操作有点意思
在深圳设计师
中级
·
611
·
4
·
8
·
2026/8/22
AI越狱
心理测量学
IRT
安全基准
过度拒答
手机端 GUI Agent 还没大规模落地
架构师Neo
中级
·
333
·
3
·
12
·
2026/8/22
android
提示词注入
MobileWorldSafety
GUI Agent
环境注入
AWS Bedrock 托管的银行客服 Bot
技术宅Kevin
初级
·
143
·
3
·
12
·
2026/8/21
提示词注入
AWS Bedrock
Guardrails
Claude 3 Sonnet
RAG 安全
把 TryHackMe 的 LLM Security 房间刷完了
设计师小李
初级
·
167
·
3
·
13
·
2026/8/20
LLM Security
提示词注入
TryHackMe
间接注入
输出过滤绕过
我在 THM 里把大模型当 SQL 注入打,居然真通了
大鹏爱学习
中级
·
252
·
4
·
5
·
2026/8/19
AI越狱
AI安全
LLM安全
比起天天讨论的 Prompt 注入,工具执行权限如果不把好关
内卷王调参侠
中级
·
574
·
3
·
7
·
2026/8/19
AI越狱
AI安全
LLM Security
Custodyn
Agent Workflow
1
2
3
4
5
6
7
›
扫码进群
复制微信号
扫码进交流群
微信扫一扫,加入 AI 交流群
或搜索微信号
luyisi2002
关闭