Atlas · GenAI 2026

Model Pruning

Removing weights or structures to cut size and latency at a controlled quality cost.

conceptPeak: 2021Model CompressionAI consensus: 1/3

Prerequisites

No prerequisites.

Recommended reference

Frankle, J., Carbin, M. (2019) "The Lottery Ticket Hypothesis" — ICLR

Notes from AI deep research

Anthropic Opus

Ustępuje kwantyzacji i destylacji jako sposób na zmniejszenie modelu

OpenAI Deep Research

Pruning odzyskał znaczenie wraz z presją na koszt inferencji, lecz jego zyski zależą od faktycznego wsparcia sprzętu [OA]

Google Deep Think

Ucięte struktury rzadko przyspieszają gęste obliczenia GPU, dlatego cała uwaga optymalizacyjna przeniosła się na efektywną kwantyzację [G]

Related skills