Y
HN Search
Hacker News Search
new
|
comments
|
top
|
jobs
loading thread…
3 ms
·
Illustrating Reinforcement Learning from Human Feedback (RLHF)
2 points
by
caprock
4y ago