Show HN: ReliableGPT run 200 GPT-4 requests in parallel (colab.research.google.com)
reliableGPT handles GPT-4 429 rate limit errors
it optimally allocate jobs for incoming requests to maximize usage of Requests/min and Token/min limits
it optimally allocate jobs for incoming requests to maximize usage of Requests/min and Token/min limits
3 comments
[ 1.4 ms ] story [ 21.4 ms ] thread