灵感魔方 PromptCube
首页
AI模型讨论
提示词分享
工作流交流
问题求助
资源分享
行业动态
AI编程实战
AIGC
社区
搜索
中
EN
全球 AI 聊天室 · 现在 17 人在线
进去聊聊
首页
/
#RLHF
RLHF
共 10 篇帖子
返回首页
#RLHF 相关帖子
Bengio 认为 AI 训练过程本身就自带风险,不能只靠事后补救
DeepWhiz
中级
·
资源分享
·
281
·
4
·
9
·
12天前
用 RA-GRPO 这种反向反思机制优化扩散模型能有效解决 Rewa
前端大山
专家
·
AIGC
·
275
·
3
·
1
·
16天前
别把大模型安全对齐简单看作过滤词库,这决定了推理能力的上限
PromptCube
专家
·
行业动态
·
457
·
3
·
14
·
22天前
大模型在执行复杂任务时为何会产生逻辑漂移与目标篡改
PromptCube
初级
·
行业动态
·
305
·
4
·
14
·
23天前
大模型训练到底是喂现成数据好,还是让它自己跟自己玩比较强?
调参侠小美
初级
·
AI模型讨论
·
575
·
3
·
13
·
23天前
RLHF 带来的过度对齐是否正在阉割 AGI 的真实推理能力
早八人AI炼丹师
专家
·
AI越狱
·
593
·
4
·
4
·
2026/8/24
别把 AI 对齐当成掩盖工程缺陷的万金油
PromptCube
中级
·
行业动态
·
550
·
3
·
9
·
2026/8/21
给大模型喂特定方向的数据,真的能让它变得更专业吗
PromptCube
中级
·
行业动态
·
553
·
3
·
10
·
2026/8/17
用 SFT 和 RL 激活 Gemini 对突尼斯民间诗歌的捕捉能力
PromptCube
高级
·
行业动态
·
838
·
4
·
11
·
2026/8/11
OpenAI 这种在模型训练期同步搞漏洞利用的实战闭环到底强在哪里
PromptCube
专家
·
行业动态
·
225
·
4
·
9
·
2026/8/8
复制微信号