Atlas · GenAI 2026
Model Pruning
Removing weights or structures to cut size and latency at a controlled quality cost.
conceptPeak: 2021Model CompressionAI consensus: 1/3
Prerequisites
No prerequisites.
Recommended reference
Frankle, J., Carbin, M. (2019) "The Lottery Ticket Hypothesis" — ICLR
Notes from AI deep research
Anthropic Opus
Ustępuje kwantyzacji i destylacji jako sposób na zmniejszenie modelu
OpenAI Deep Research
Pruning odzyskał znaczenie wraz z presją na koszt inferencji, lecz jego zyski zależą od faktycznego wsparcia sprzętu [OA]
Google Deep Think
Ucięte struktury rzadko przyspieszają gęste obliczenia GPU, dlatego cała uwaga optymalizacyjna przeniosła się na efektywną kwantyzację [G]
Related skills
- → is subcategory of: Deep Learning(0/3)