5 ms·
This isn't unreasonable. ML workloads benefit from more computational time per request. Lower QPS = better results.
by nick0garvey 3y ago
This isn't unreasonable. ML workloads benefit from more computational time per request. Lower QPS = better results.