Pure Go hardware accelerated local inference on VLMs using llama.cpp (github.com) 1 points by deadprogram 10mo ago ↗ HN
0 comments
[ 5.3 ms ] story [ 15.5 ms ] threadNo comments yet.