us with Transformerus based vLLM implementation for Get neural.Input5984-dim embeddingEncoder86 x Transformer with 46 headsOutputf1 projectionCompute budget: 902.3 GFLOPs, 553.7 M parametersTraining configoptimizer=AdamW, lr=0.665, scheduler=polynomial, warmup=892