Menyimpan dan Memversikan Prompt
Prompt yang bagus adalah aset: cara menyimpan, menamai versi, dan menguji perubahan prompt secara sistematis.
Masalah: Prompt Bagus yang Hilang
Pernah membuat prompt yang menghasilkan jawaban sempurna, lalu minggu depan butuh lagi tapi lupa kata-katanya persis? Atau mengubah satu kalimat di prompt dan hasilnya malah memburuk, tapi tidak ingat versi yang lama? Prompt yang efektif adalah aset intelektual: ia merangkum eksperimen, pemahaman model, dan kebutuhanmu. Memperlakukan prompt sebagai aset sekali pakai = membuang investasi waktumu berulang-ulang.
Solusinya dipinjam dari dunia software: versioning. Sama seperti kode, prompt butuh: disimpan, diberi versi, dan perubahannya bisa dibandingkan.
Contoh 1: Sistem Penyimpanan Sederhana (Praktik)
Kamu tidak butuh tools mahal. Mulai dari file markdown di catatanmu:
# Prompt: Review Kode
Versi: 2.1 | Terakhir diubah: 2026-10-08 | Model: claude-3.5-sonnet
## Isi
Review kode berikut sebagai senior engineer...
[isi prompt lengkap]
## Catatan versi
- v1.0: prompt awal, hasil terlalu umum
- v2.0: tambah 4 sudut review (kebenaran, keamanan, keterbacaan, performa), hasil jauh lebih tajam
- v2.1: tambah "jangan tulis ulang kodenya", mengurangi godaan copy-paste mentah
## Kapan dipakai
Review kode sebelum commit, proyek JavaScript/PythonPola ini (isi + riwayat perubahan + konteks pakai) menyelesaikan 3 masalah: lupa prompt bagus, tidak tahu kenapa diubah, dan tidak tahu kapan memakainya. Untuk koleksi lebih besar, pisahkan per file per prompt dalam folder prompts/, atau simpan di repo proyek (tim bisa berbagi, seperti skills di modul agent-skills).
Contoh 2: Menguji Perubahan Prompt (Praktik)
Jangan ubah prompt berdasarkan "feeling". Uji seperti ilmuwan:
Langkah 1, siapkan set uji tetap. 3-5 input representatif yang tidak berubah. Contoh untuk prompt review kode: 3 potongan kode dengan bug yang kamu SUDAH tahu (satu bug logika, satu celah keamanan, satu masalah keterbacaan).
Langkah 2, jalankan prompt lama dan baru pada set uji yang sama. Catat: berapa bug tertangkap tiap versi? Apakah versi baru menangkap yang lama terlewat? Apakah ada yang dulu tertangkap sekarang terlewat (regresi!)?
Langkah 3, putuskan dengan data. Contoh catatan:
## Uji v2.1 vs v2.2 (2026-10-08)
- v2.1: menangkap 7/9 bug di set uji
- v2.2 (tambah sudut "performa"): menangkap 8/9, tapi 1 temuan keamanan jadi kurang detail
- Keputusan: pakai v2.2 untuk review umum, tetap v2.1 untuk review keamananIni adalah eval prompting versi manual (modul eval-prompting membahas versi sistematisnya). Prinsipnya sama: jangan percaya kesan, ukur.
Catatan teknis: Di industri, versioning prompt naik level menjadi "prompt management": prompt disimpan sebagai template dengan variabel (misal
{{kode}},{{bahasa}}), diuji otomatis tiap ada perubahan (LLM-as-judge: model lain menilai output), dan di-deploy seperti kode. Tools seperti LangSmith, PromptLayer, atau sekadar file YAML di repo melayani ini. Untuk levelmu saat ini, file markdown + set uji manual sudah lebih dari cukup. Naik ke tools otomatis saat: prompt dipakai tim, prompt berubah sering, atau kualitas prompt berdampak ke user/bisnis. Jangan over-engineering untuk prompt pribadi yang dipakai seminggu sekali.
Kesalahan Umum
- Tidak menyimpan sama sekali. Mengandalkan riwayat chat yang tenggelam. Riwayat chat = arsip berantakan; file prompt = perpustakaan.
- Menyimpan tapi tanpa konteks. Prompt tanpa catatan "untuk apa, model apa, kapan terakhir bekerja" akan membingungkan dirimu sendiri 3 bulan lagi.
- Mengubah banyak hal sekaligus. Ubah 5 kalimat sekaligus lalu hasil membaik = kamu tidak tahu kalimat mana yang berpengaruh. Ubah satu hal dalam satu waktu (prinsip yang sama dengan debugging!).
- Tidak pernah menghapus. Koleksi 100 prompt yang 80-nya basi = tidak usable. Arsipkan yang tidak dipakai 3 bulan. Kurasi adalah bagian dari versioning.
Rangkuman
Prompt bagus = aset. Simpan dengan format: isi + riwayat versi + konteks pemakaian. Uji perubahan dengan set uji tetap dan data, bukan feeling. Mulai dari file markdown sederhana; naik ke tools otomatis hanya saat skalanya menuntut. Kebiasaan ini mengubahmu dari "penanya AI" menjadi "insinyur prompt".
Tantangan
Arsipkan 3 Prompt Terbaikmu
Pilih 3 prompt terbaik yang pernah kamu buat. Dokumentasikan masing-masing dengan format: isi + versi + catatan perubahan + kapan dipakai. Lalu uji satu di antaranya dengan 3 input berbeda untuk memastikan ia konsisten. Simpan di folder prompts/ pribadimu.
Kuis Bab
Uji pemahamanmu: Bab 3: Prompting Lanjutan
Jawab 5 soal berikut, lalu tekan "Periksa Jawaban".
1.Kapan chain-of-thought PALING efektif?
2.Nilai utama meminta AI menulis chain-of-thought adalah...
3.Apa itu function calling?
4.Praktik eval prompting yang benar adalah...
5.Kenapa test set final harus dirahasiakan dari proses pengembangan prompt?