2 ms·
My intuition on this: Maximum likelihood training -> faithfully represent training data Reinforcement learning -> seek out the most preferred answer you can
by gradys 3y ago
My intuition on this:
Maximum likelihood training -> faithfully represent training data
Reinforcement learning -> seek out the most preferred answer you can