Efficient Cardiac Image Segmentation with Compressed Vision Transformers and Post-training Quantization
摘要
The high prevalence of cardiovascular diseases (CVDs) worldwide requires accurate diagnostic imaging, particularly through magnetic resonance imaging (MRI). The framework includes preprocessing for region-of-interest segmentation via ViTs, followed by PTQ to reduce model size while maintaining segmentation accuracy. Using a small calibration dataset, we apply PTQ to compress the ViT, significantly reducing storage requirements and latency without compromising precision. Experimental results indicate that Float16 quantization achieves an optimal balance between compression rate and segmentation accuracy, demonstrating the feasibility of ViTs for real-time applications.