Learn how to run large language models on edge devices using compression and quantization. Explore PTQ, QAT, GPTVQ, and tools like AIMET for efficient local AI deployment.