Hacker News new | ask | show | jobs
Reinforcement learning towards broadly and persistently beneficial models (alignment.openai.com)
2 points by spicypete 33 days ago