Learning track

Inference & Efficiency

Understand how trained models generate text and how decoding choices trade off diversity, coherence, latency, and cost.