Optimizing Distributed Training on Frontier for Large Language Models (arxiv.org) 2 points by arcanus 2y ago ↗ HN
0 comments
[ 3.9 ms ] story [ 12.1 ms ] threadNo comments yet.