Wesum AI
首页
图谱
主题百科
首页
/
图谱
/
RM-R1
RM-R1
模型
在陪伴场景下被验证与人类判断呈负相关的奖励模型
1 次提及
1 个连接
首次出现: 2026-07-01
最近出现: 2026-07-01
关系图谱
关系 (1)
使用技术 (1)
强化学习
相关文章 (1)
1.
AI前线 - 高德GrowLoop:构建感性对话的理性Benchmark