Universal and Transferable Adversarial Attacks on Aligned Language Models (llm-attacks.org) 14 points by llazzaro 3y ago ↗ HN
0 comments
[ 3.3 ms ] story [ 11.6 ms ] threadNo comments yet.