美国商务部AI安全部门负责人离职:监管套路是不是走到了死胡同?
这种高层人事变动往往比新闻稿本身有意思。一个负责AI安全的人突然离职,最直接的信号就是内部对“安全”的定义可能产生了严重分歧。在现在的大模型环境下,所谓的安全经常被简化成几个过滤词库或死板的对齐策略,这在实际开发中简直是灾难。
下一篇
Kimi K3 Abliterated:黑盒软件红蓝对抗的新玩具 →
从技术视角看,现在的AI安全路径基本分成了两派:一派是死磕RLHF和系统提示词,试图给模型套上枷锁;另一派则是追求Abliterated(去审查)或 Uncensored 模型,认为只有去掉人为的偏见和限制,模型才能发挥最大效能。
如果监管层的人员流动频繁,说明那种“自上而下”的强行定义安全机制可能在实操中遇到了瓶颈。毕竟对于开发者来说,一个因为过度对齐而变得像个机器人一样死板的模型,其商业价值远低于一个能灵活处理复杂指令的Agent。
这种变动大概率预示着接下来的AI安全方向会从简单的“禁止回答”转向更深层的架构级治理,或者说,监管方终于意识到单纯靠行政指令没法解决提示词工程里的各种绕过技巧。