Inside LLM Inference: From Silicon to Served Token - A Measured Guide to How Language Models Run on GPUs | Myboeken