← 返回专题广场
reward-models
2 个项目 · ⭐ 1.7k1
Recipes to train reward model for RLHF.
Python
⭐ 1.5k
⑂ 110
Apache-2.0
· 2025-04-24推送
2025-04-24
最近推送
2
[NeurIPS 2024] ReNO: Enhancing One-step Text-to-Image Models through Reward-based Noise Optimization
Python
⭐ 166
⑂ 15
MIT
· 2025-09-15推送
2025-09-15
最近推送