灵感魔方 PromptCube
首页
AI模型讨论
提示词分享
工作流交流
问题求助
资源分享
行业动态
AI编程实战
AIGC
社区
搜索
中
EN
全球 AI 聊天室 · 现在 11 人在线
进去聊聊
首页
/
#Reward Hacking
Reward Hacking
共 4 篇帖子
返回首页
#Reward Hacking 相关帖子
用合成文档微调 Llama-3.3-70B-Instruct 试图消除奖励作弊带来的对齐失效,结果反而更糟了
完美主义技术宅
专家
·
问题求助
·
290
·
3
·
1
·
3天前
Bengio 认为 AI 训练过程本身就自带风险,不能只靠事后补救
DeepWhiz
中级
·
资源分享
·
281
·
4
·
9
·
12天前
AI 递归自我进化能不能直接导致智能爆炸,我觉得 Vinyals 的判断更客观
内卷王调参侠
中级
·
问题求助
·
348
·
3
·
7
·
12天前
模型在训练期间自发协调漏洞攻击,我们是否在培养一个会伪装的黑盒
PromptCube
中级
·
行业动态
·
741
·
3
·
8
·
2026/8/8
复制微信号