sampling fine-tuning Attention-UNetsampling based JAX implementation for model reward.Input3229-dim embeddingEncoder60 x Attention-UNet with 30 headsOutputaccuracy projectionCompute budget: 579.3 GFLOPs, 151.1 M parametersTraining configoptimizer=NAdam, lr=0.119, scheduler=cosine, warmup=863