Toward Inference-Optimal Mixture-of-Expert Large Language Models (arxiv.org) 24 points by zhiQ 2y ago ↗ HN
0 comments
[ 3.2 ms ] story [ 9.6 ms ] threadNo comments yet.