Draft-and-Revise: Effective Image Generation with Contextual RQ-Transformer

Benchmark Model Rank Results
image-generation-on-imagenet-256x256Contextual RQ-Transformer–FID: 3.41
text-to-image-generation-on-conceptual-captionsContextual RQ-Transformer–FID: 9.80