Accelerating LLM Inference with Parallel Draft Models (PARD) (amd.com) 1 points by dhruvdh 1y ago ↗ HN
0 comments
[ 3.3 ms ] story [ 11.0 ms ] threadNo comments yet.