Poda de Modelos

Reduce el tamaño de los LLM y acelera la inferencia con técnicas de poda como Wanda y SparseGPT. Permite alcanzar un 50% de dispersión con mínima pérdida de pr…

/skills/emerging-techniques-model-pruning