Y
HN Search
Hacker News Search
new
|
comments
|
top
|
jobs
loading thread…
4 ms
·
RLHF: Reinforcement Learning from Human Feedback
1 points
by
panabee
2y ago