ksm26/Reinforcement-Learning-from-Human-Feedback
Embark on the "Reinforcement Learning from Human Feedback" course and align Large Language Models (LLMs) with human values.
⭐ 13
⑂ 9
Jupyter Notebook
· 2024-01-31推送
13
Watchers
0
贡献者
0
Commits
0
Releases
0
Open Issues
2024-01-31
最近推送
原文
中文
暂无 README