Nvidia’s Llama-3.1-Minitron 4B is a small language model that punches above its weight
https://venturebeat.com/ai/nvidias-llama-3-1-minitron-4b-is-a-small-language-model-that-punches-above-its-weight/

VentureBeat
Nvidia’s Llama-3.1-Minitron 4B is a small language model that punches above its weight
Nvidia researchers used model pruning and distillation to create a small language model (SLM) at a fraction of the base cost.
4August 23, 2024 30.3K 12