ksm26

ksm26/Reinforcement-Learning-from-Human-Feedback

Embark on the "Reinforcement Learning from Human Feedback" course and align Large Language Models (LLMs) with human values.

⭐ 13 ⑂ 9 Jupyter Notebook · 2024-01-31推送
13
Watchers
0
贡献者
0
Commits
0
Releases
0
Open Issues
2024-01-31
最近推送
原文 中文
暂无 README