CarperAI/trlx
A repo for distributed training of language models with Reinforcement Learning via Human Feedback (RLHF)
⭐ 4.8k
⑂ 486
Python
MIT
· 2024-01-09推送
4.8k
Watchers
0
贡献者
0
Commits
0
Releases
102
Open Issues
2024-01-09
最近推送
原文
中文
暂无 README