← 返回专题广场
safe-reinforcement-learning-from-human-feedback
1 个项目 · ⭐ 1.6k1
Safe RLHF: Constrained Value Alignment via Safe Reinforcement Learning from Human Feedback
Python
⭐ 1.6k
⑂ 133
Apache-2.0
· 2025-11-24推送
2025-11-24
最近推送