Compress image to patches for Vision Transformer

Benchmark Model Rank Results
image-classification-on-imagenetCI2P-ViT#838Top 1 Accuracy: 77%GFLOPs: 6.442