Q Quantization Model ağırlıklarının daha düşük hassasiyetli sayı formatlarına dönüştürülmesidir. Model boyutunu küçültür ve inference hızını artırır.