Poda de Modelos
Reduce el tamaño de los LLM y acelera la inferencia con técnicas de poda como Wanda y SparseGPT. Permite alcanzar un 50% de dispersión con mínima pérdida de pr…
Reduce el tamaño de los LLM y acelera la inferencia con técnicas de poda como Wanda y SparseGPT. Permite alcanzar un 50% de dispersión con mínima pérdida de pr…