3 ms·Multi-GPU Inference with Accelerate14 points by nebrelbug 3y agonebrelbug 3y agoQuick tutorial on how to use Accelerate to run inference on LLMs in parallel