Reinforcement learning towards broadly and persistently beneficial models (alignment.openai.com) 2 points by spicypete 2mo ago ↗ HN
0 comments
[ 3.6 ms ] story [ 9.7 ms ] threadNo comments yet.