Preprint2024
Papers Explained 187e: Quantized Llama 3.2, Llama 3.3
Unknown
Meta's quantized Llama 3.2 and Llama 3.3 models reduce size and memory via QAT with LoRA and SpinQuant, enabling deployment on mobile devices.
0Oct 1, 2024Quantization
A comprehensive index of artificial intelligence and machine-learning research with AI-generated summaries, citation metrics, and direct links to papers and code.