SFT praktis dengan TRL/Unsloth
M9 — Fine-tuning & Alignment
Tutorial praktis Supervised Fine-Tuning (SFT) menggunakan library Unsloth dan Hugging Face TRL (Transformer Reinforcement Learning).
Topik Praktik:
- Konfigurasi parameter LoRA (r, lora_alpha, target_modules).
- Optimasi memori dengan Gradient Checkpointing dan Paged AdamW.
M9