Scaling Reinforcement Learning for Trillion-Scale Thinking Model (arxiv.org) 3 points by mountainview 10mo ago ↗ HN
0 comments
[ 3.2 ms ] story [ 7.5 ms ] threadNo comments yet.