What's included:
• Efficient fine-tuning using LoRA and QLoRA techniques
• Dataset formatting, cleaning, and instruction-tuning setup
• Model evaluation, validation, and quantization (GGUF/AWQ)
• Exported model artifacts ready for low-latency inference