Operations Overview
Peta operasi untuk deployment self-hosted Custelio. Halaman ini menunjuk operator ke artikel yang menangani tiap tanggung jawab; artikel tujuan memuat langkah dan batasnya masing-masing. Produk belum mengklaim deployment produksi siap dipakai (production-ready) — setiap lingkungan wajib melewati gate operasionalnya sendiri sebelum menangani beban nyata.
Tujuan
Operator mengetahui artikel mana yang dipakai untuk deployment, verifikasi kesehatan, backup/restore, dan troubleshooting tanpa menganggap sehat layanan yang tidak sehat.
Untuk siapa
Operator/SRE dan platform admin yang menjalankan dan memelihara deployment.
Prasyarat
- Akses ke environment deployment, log service, dan konfigurasi.
- Backup valid tersedia sebelum tindakan destruktif.
Area operasi
Deployment dan konfigurasi
- Deployment dan runtime — menjalankan stack Docker Compose, variabel environment, CORS, rate limit, body size, dan keamanan dasar.
- Storage dan Platform — PostgreSQL, Redis, object storage, dan satu sumber kebenaran kredensial.
Backup dan pemulihan
- Backup dan restore — kebijakan RPO/RTO, prosedur backup, restore drill, dan restore insiden.
Troubleshooting
- Troubleshooting — kode error umum, health/readiness, dan diagnosis dari log service.
Administrasi terkait operasi
- Sesi Provider WAHA — sesi gateway WhatsApp yang memengaruhi pengiriman percakapan.
- Migrasi Chatwoot — alur migrasi eksperimental yang membutuhkan backup dan dry run.
Prinsip operasi
- Jangan menganggap container hidup = sehat. Verifikasi dari endpoint health/readiness yang benar-benar tersedia; tanpa endpoint, jangan klaim sehat.
- Diagnosis dari log service, bukan asumsi; konflik port dan env salah adalah penyebab startup gagal yang umum.
- Backup tanpa restore teruji bukan perlindungan. Backup dan drill restore adalah satu kesatuan.
- Jangan menonaktifkan keamanan sebagai workaround. TLS, verifikasi HMAC, origin check, dan access control tidak boleh dimatikan untuk memulihkan layanan.
- Jangan mencetak secret/PII ke log dan batasi akses metrik publik.
Jika terjadi masalah
- Container crash / tidak sehat: jangan menganggap hidup = sehat; baca log service dan periksa health/readiness yang benar-benar tersedia. Lihat Deployment dan runtime dan Troubleshooting.
- Data hilang atau korup: hentikan penulisan baru bila memungkinkan, lalu pulihkan dari backup terverifikasi melalui prosedur di Backup dan restore.
- Backup gagal: perbaiki di sumber konfigurasi dan verifikasi berkasnya; jangan membiarkan kegagalan menumpuk diam-diam.
- Restore tidak cocok: bandingkan entitas/berkas dengan titik backup dan ulangi dari dump valid; jangan menambal data.
- Sesi provider bermasalah: periksa Sesi Provider WAHA sebelum menganggap pengiriman gagal.
- Jangan menonaktifkan keamanan (TLS, HMAC, origin check, access control) sebagai workaround pemulihan.
Tanda berhasil
Operator dapat menunjuk artikel untuk tiap tugas, menjalankan deployment dengan konfigurasi eksplisit, memverifikasi status dari sumber yang benar, dan membuktikan pemulihan lewat drill.
Batasan
Dokumentasi ini tidak mengklaim readiness produksi, RPO/RTO bawaan, atau cakupan operasional di luar artikel yang ditautkan. Fitur tertentu masih limited/experimental dan tidak boleh dianggap stabil produksi tanpa verifikasi deployment sendiri.