3 ms·
Compressing Large Language Models using Low Rank and Low Precision Decomposition https://arxiv.org/abs/2405.18886 https://arxiv.org/abs/2405.18886
by throwaway888abc 2y ago
Compressing Large Language Models using Low Rank and Low Precision Decomposition
https://arxiv.org/abs/2405.18886 https://arxiv.org/abs/2405.18886