Y
HN Search
Hacker News Search
new
|
comments
|
top
|
jobs
loading thread…
2 ms
·
Explaining Reinforcement Learning with Human Feedback (RLHF)
11 points
by
echen
4y ago