Reinforcement Learning Finetunes Small Subnetworks in Large Language Models (arxiv.org) 3 points by s-macke 1y ago ↗ HN
0 comments
[ 2.8 ms ] story [ 7.9 ms ] threadNo comments yet.