Q Quantization Quantization, model ağırlıklarını daha düşük sayısal hassasiyete indirerek bellek kullanımını ve çıkarım maliyetini azaltır.