3 ms·Back to TF IDF we go.by pkoird 1y agoBack to TF IDF we go.knuppar 1y agoOne could argue TF-IDF is a case of an attention layer... but not quadratic in inference/training and kinda just a quotient. Yeah maybe we should go back