3 ms·The inference providers are running batch sizes much larger than 10by ac29 3mo agoThe inference providers are running batch sizes much larger than 10