Errata & Rekonsiliasi¶
Halaman ini mendaftar poin-poin di mana informasi antar sumber dokumen (laporan 6 Juli vs sesi kerja 7–8 Juli) berbeda, beserta status/kondisi terkini yang sudah diverifikasi.
| # | Topik | Laporan 6 Juli (sispada) | Kondisi Terverifikasi 8 Juli 2026 | Status |
|---|---|---|---|---|
| 1 | Kapasitas disk storage node | Disk vdb 10GB/node (~30GB total raw) — ditandai sebagai risiko kapasitas |
Disk vdb 120GB/node (~360GB raw, ~120GB usable replika 3×), diverifikasi langsung via lsblk/df -h pada VM storage |
✅ Resolved — sudah diperbesar |
| 2 | WireGuard handshake | Peer 0 berhasil handshake & transfer data (31 menit sebelum laporan dibuat) | Ditemukan seluruh 5 peer menunjukkan latest handshake = 0 saat sesi 7-8 Juli dimulai — tunnel rusak kembali setelah laporan 6 Juli dibuat |
🔧 Root cause baru ditemukan & diperbaiki (bug VM_ID/VMID, berbeda dari bug interface IN/OUT yang dilaporkan sebelumnya) |
| 3 | Akses Longhorn UI | http://103.226.174.229/longhorn (path-based, HTTP saja, direkomendasikan tambah reverse-proxy HTTPS+basic-auth) |
https://oneke-longhorn.ums.id/ (domain + Let's Encrypt trusted + IP whitelist + Basic Auth) |
✅ Ditingkatkan ke metode yang direkomendasikan laporan asli |
| 4 | Akses Kubernetes Dashboard | https://103.226.174.229:8443 (IP:port, sertifikat self-signed Dashboard) |
https://oneke-dashboard.ums.id/ (domain + Let's Encrypt trusted via nginx lokal) |
✅ Ditingkatkan |
| 5 | Enable Traefik | Direncanakan NO (Opsi D pakai HAProxy/Ingress Controller) | YES — realisasi oneadmin memakai Traefik, dan seluruh eksposur layanan (Longhorn, Dashboard, demo-app) pada sesi 7-8 Juli dibangun di atas Traefik Ingress | ℹ️ Konsisten dengan Perubahan Konfigurasi A.2 |
| 6 | Storage role cardinality | Direncanakan 0 (Longhorn di worker) | 3 storage node khusus (VM 28-30) — sudah dikonfirmasi tetap dan kapasitasnya sudah ditingkatkan (lihat #1) | ℹ️ Realisasi permanen, bukan sementara |
| 7 | Database cluster (Galera/ProxySQL/Redis) | Direncanakan, sizing lengkap tersedia (SEKSI-01/02) | Galera cluster (3 node) sudah di-deploy & sehat; ProxySQL/Redis ditunda. PostgreSQL+Patroni (3 node) juga di-deploy berdampingan (bukan pengganti) atas permintaan Admin | ✅ Diimplementasikan — lihat Instalasi MariaDB Galera & Instalasi PostgreSQL+Patroni |
| 8 | Disk VM VNF (10.0.0.1) | Tidak tercatat di laporan 6 Juli | Ditemukan 100% penuh (1.9GB) saat sesi 8 Juli — penyebab: .vscode-server (1.7GB) sisa sesi kerja lokal sebelumnya, termasuk proses claude auth status macet berjam-jam. Disk diperbesar ke 5GB, .vscode-server dihapus |
✅ Resolved — disk 4% terpakai setelah bersih-bersih |
| 9 | CPU VM Master (10.0.0.2) | Tidak tercatat di laporan 6 Juli | kubectl top nodes sempat menunjukkan 100% CPU — ternyata bukan beban K8s control-plane, melainkan proses claude auth status macet (1168 & 701 menit CPU akumulasi) dari sisa .vscode-server (2.5GB). Dibersihkan |
✅ Resolved — CPU turun ke 23% setelah proses macet dimatikan |
| 10 | Akses Kubernetes Dashboard (lanjutan #4) | https://oneke-dashboard.ums.id/ (domain terpisah, HTTPS trusted) |
Domain sempat gagal (self-signed cert) — HAProxy backend tertimpa balik ke passthrough langsung. Dipindahkan ke https://oneke.ums.id/oneke-dashboard/ (path-based, arsitektur lebih sederhana via Traefik langsung); domain lama redirect 301 ke path baru |
✅ Dimigrasikan — lihat Laporan Kerja |
| 11 | Akses Longhorn UI (lanjutan #3) | https://oneke-longhorn.ums.id/ (domain terpisah, IP whitelist + Basic Auth) |
Dipindahkan ke https://oneke.ums.id/longhorn/ (path resmi vendor Longhorn) — IP whitelist dihapus (keterbatasan teknis SNI di path bersama, keputusan sadar), Basic Auth dipertahankan. Domain lama redirect 301 |
✅ Dimigrasikan — lihat Laporan Kerja |
| 12 | ACL IP whitelist Longhorn di HAProxy | Ditambahkan 7 Juli (lihat #Web Security Longhorn) | Ditemukan sudah hilang dari servers.cfg saat pengecekan 8 Juli — kena dampak insiden revert yang sama dengan Dashboard (#10) |
ℹ️ Tidak masalah — proteksi sudah direncanakan dihapus di migrasi #11 |
| 13 | StorageClass longhorn-hdd |
Disebut sejak dokumen rencana awal (untuk data umum/backup, bukan storage DB) | Ternyata tidak pernah benar-benar dibuat di cluster — baru ketahuan saat deployment Prometheus gagal dengan error "storage class does not exist" pada 8 Juli | ✅ Dibuat (replika 2×, atas permintaan Admin) — lihat Instalasi Monitoring §2 |
| 14 | ServiceMonitor/PodMonitor baru tidak muncul di Prometheus | Tidak berlaku (fitur baru) | Config Secret Prometheus Operator sudah benar diregenerasi, tapi Pod yang sedang berjalan tidak me-refresh mount Secret-nya (cache kubelet basi) — target baru tidak muncul sama sekali sampai Pod di-restart manual | 🔧 Root cause ditemukan & diperbaiki — lihat Instalasi Monitoring §8 |
Ringkasan Kondisi Terkini (8 Juli 2026)¶
- Platform K8s (RKE2, Cilium, MetalLB, Longhorn, Traefik): berjalan sehat
- WireGuard VNF: diperbaiki, config stabil, belum ada client aktif memakainya
- Longhorn UI & Kubernetes Dashboard: diekspos dengan HTTPS trusted ke domain masing-masing
- Halaman utama
oneke.ums.id: diarahkan kedemo-app(placeholder + navigasi) - Galera cluster (MariaDB) 3 node: berjalan sehat, backup terjadwal ke S3 aktif, failover teruji — lihat Instalasi MariaDB Galera
- PostgreSQL + Patroni 3 node: berjalan berdampingan dengan Galera (namespace terpisah),
synchronous_modeaktif, backup WAL-G + WAL archiving kontinu (PITR) ke S3, failover teruji — lihat Instalasi PostgreSQL + Patroni - Monitoring (Prometheus + Grafana):
kube-prometheus-stackkhusus oneKE berjalan sehat, mengumpulkan metrik Longhorn, Traefik, Patroni, dan Galera; Grafana diekspos dihttps://oneke.ums.id/grafana/— lihat Instalasi Monitoring - Storage upload user: disk baru 512GB/node dari datastore OpenNebula
image_hdd(101) ditambahkan ke 3 storage node, terisolasi dari disk database via StorageClasslonghorn-uploads(diskSelector tag) — lihat Penambahan Storage Uploads - Monitor custom di homepage: widget status real-time (VM aktif, kesehatan aplikasi,
pemakaian resource total/per-VM/per-aplikasi) tampil di
https://oneke.ums.id/, didukung API customstatus-apiyang query Prometheus + Kubernetes API — lihat Monitor Custom di Homepage - Endpoint S3 khusus oneKE (
oneke-s3.ums.id) dibangun di atas infrastruktur MinIO UMS yang sudah ada, terpisah dari bucket aplikasi lain - VM VNF & Master:
.vscode-serversisa sesi lama (total ~4.2GB gabungan) dibersihkan, beberapa proses macet yang menghabiskan CPU/disk signifikan ikut dihentikan
Halaman ini dipelihara untuk menjaga konsistensi antar dokumen seiring cluster terus berkembang.