2 ms·Models self-report difference between RLHF trained responses and base cognition2 points by daniel-navarro 6mo agodaniel-navarro 6mo ago[dead]