Entity
Adaptive Quantization
Method that automatically adjusts numerical precision levels in neural network layers based on their sensitivity to maintain accuracy while reducing memory usage.
术语属性
- application:Model Compression
- impact:Improved Efficiency