Hacker News new | ask | show | jobs
Reinforcement learning towards broadly and persistently beneficial models (alignment.openai.com)
1 points by jawiggins 43 days ago