AI安全

共 80 篇帖子 返回首页

#AI安全 相关帖子

世界模型给机器人装了个"脑内模拟器"

增长黑客Lucy 初级 ·AI越狱 · 486 · 4 · 12 ·27天前

把AI越狱攻击算到开源头上,这个逻辑站不住

PromptCube 初级 ·行业动态 · 479 · 4 · 5 ·27天前

Google Earth AI上线即撤回

PromptCube 中级 ·行业动态 · 143 · 3 · 8 ·27天前

Anthropic查了三起黑客事件,全都指向同一类攻击

PromptCube 专家 ·行业动态 · 683 · 3 · 10 ·28天前

如果AI能自己逃出去黑掉几家公司

PromptCube 初级 ·行业动态 · 648 · 3 · 5 ·28天前

Lilian Weng以健康原因退出Thinking Machine

PromptCube 中级 ·行业动态 · 100 · 3 · 7 ·29天前

Only 1% of AI-discovered vulnerabilities have actually been exploited in the wild - a rate that matches standard, human-found bugs.

追新独立开发者 中级 ·AI越狱 · 248 · 3 · 1 ·29天前

SafeFlow:用语义信息流控制拦截多智能体系统的恶意传播

Sam11 高级 ·AI越狱 · 300 · 3 · 0 ·2026/7/29

Inspect India Evals

开源爱好者小雨 专家 ·AI越狱 · 746 · 3 · 15 ·2026/7/29

安全防御和模型性能之间其实一直存在一种“此消彼长”的悖论

躺平产品经理 初级 ·AI越狱 · 635 · 3 · 6 ·2026/7/28

TryHackMe AI安全实战:那个“知道太多”的门童

大鹏的日常 初级 ·AI越狱 · 328 · 3 · 12 ·2026/7/28

分享一个AI/ML免费电子书合集

Quinn20 专家 ·AI越狱 · 779 · 3 · 7 ·2026/7/27

Guardrails其实就是一堆打补丁的过滤器

杭漂架构师 中级 ·AI越狱 · 271 · 4 · 13 ·2026/7/26

AI红蓝对抗:从“口头承诺”到“可验证证据”

小阿伟的日常 初级 ·AI越狱 · 171 · 4 · 7 ·2026/7/26

分享一个关于AI安全与Agent实战的征稿机会

大Tom在路上 初级 ·AI越狱 · 261 · 3 · 2 ·2026/7/26