Chain-of-thought (paper)
M5 — Prompt Engineering
Paper Wei et al. (Google Research, 2022) yang membuktikan bahwa meminta LLM menguraikan langkah penalaran sebelum menjawab (Chain-of-Thought) secara masif meningkatkan kemampuan penalaran logika, matematika, dan multi-step problem solving.
Varian Utama
- Manual CoT: Menyertakan contoh few-shot yang berisi kalimat penalaran bertahap ("Mari kita hitung langkah demi langkah...").
- Zero-Shot CoT (Kojima et al.): Cukup menambahkan frasa pemicu
"Let's think step by step"di akhir prompt. - Self-Consistency: Melakukan sampling ganda (misal 5 jalur CoT dengan temperature > 0) lalu mengambil jawaban konsensus terbanyak (majority voting).
M5