Errata & Rekonsiliasi

Halaman ini mendaftar poin-poin di mana informasi antar sumber dokumen (laporan 6 Juli vs sesi kerja 7–8 Juli) berbeda, beserta status/kondisi terkini yang sudah diverifikasi.

# Topik Laporan 6 Juli (sispada) Kondisi Terverifikasi 8 Juli 2026 Status
1 Kapasitas disk storage node Disk vdb 10GB/node (~30GB total raw) — ditandai sebagai risiko kapasitas Disk vdb 120GB/node (~360GB raw, ~120GB usable replika 3×), diverifikasi langsung via lsblk/df -h pada VM storage Resolved — sudah diperbesar
2 WireGuard handshake Peer 0 berhasil handshake & transfer data (31 menit sebelum laporan dibuat) Ditemukan seluruh 5 peer menunjukkan latest handshake = 0 saat sesi 7-8 Juli dimulai — tunnel rusak kembali setelah laporan 6 Juli dibuat 🔧 Root cause baru ditemukan & diperbaiki (bug VM_ID/VMID, berbeda dari bug interface IN/OUT yang dilaporkan sebelumnya)
3 Akses Longhorn UI http://103.226.174.229/longhorn (path-based, HTTP saja, direkomendasikan tambah reverse-proxy HTTPS+basic-auth) https://oneke-longhorn.ums.id/ (domain + Let's Encrypt trusted + IP whitelist + Basic Auth) Ditingkatkan ke metode yang direkomendasikan laporan asli
4 Akses Kubernetes Dashboard https://103.226.174.229:8443 (IP:port, sertifikat self-signed Dashboard) https://oneke-dashboard.ums.id/ (domain + Let's Encrypt trusted via nginx lokal) Ditingkatkan
5 Enable Traefik Direncanakan NO (Opsi D pakai HAProxy/Ingress Controller) YES — realisasi oneadmin memakai Traefik, dan seluruh eksposur layanan (Longhorn, Dashboard, demo-app) pada sesi 7-8 Juli dibangun di atas Traefik Ingress ℹ️ Konsisten dengan Perubahan Konfigurasi A.2
6 Storage role cardinality Direncanakan 0 (Longhorn di worker) 3 storage node khusus (VM 28-30) — sudah dikonfirmasi tetap dan kapasitasnya sudah ditingkatkan (lihat #1) ℹ️ Realisasi permanen, bukan sementara
7 Database cluster (Galera/ProxySQL/Redis) Direncanakan, sizing lengkap tersedia (SEKSI-01/02) Galera cluster (3 node) sudah di-deploy & sehat; ProxySQL/Redis ditunda. PostgreSQL+Patroni (3 node) juga di-deploy berdampingan (bukan pengganti) atas permintaan Admin Diimplementasikan — lihat Instalasi MariaDB Galera & Instalasi PostgreSQL+Patroni
8 Disk VM VNF (10.0.0.1) Tidak tercatat di laporan 6 Juli Ditemukan 100% penuh (1.9GB) saat sesi 8 Juli — penyebab: .vscode-server (1.7GB) sisa sesi kerja lokal sebelumnya, termasuk proses claude auth status macet berjam-jam. Disk diperbesar ke 5GB, .vscode-server dihapus Resolved — disk 4% terpakai setelah bersih-bersih
9 CPU VM Master (10.0.0.2) Tidak tercatat di laporan 6 Juli kubectl top nodes sempat menunjukkan 100% CPU — ternyata bukan beban K8s control-plane, melainkan proses claude auth status macet (1168 & 701 menit CPU akumulasi) dari sisa .vscode-server (2.5GB). Dibersihkan Resolved — CPU turun ke 23% setelah proses macet dimatikan
10 Akses Kubernetes Dashboard (lanjutan #4) https://oneke-dashboard.ums.id/ (domain terpisah, HTTPS trusted) Domain sempat gagal (self-signed cert) — HAProxy backend tertimpa balik ke passthrough langsung. Dipindahkan ke https://oneke.ums.id/oneke-dashboard/ (path-based, arsitektur lebih sederhana via Traefik langsung); domain lama redirect 301 ke path baru Dimigrasikan — lihat Laporan Kerja
11 Akses Longhorn UI (lanjutan #3) https://oneke-longhorn.ums.id/ (domain terpisah, IP whitelist + Basic Auth) Dipindahkan ke https://oneke.ums.id/longhorn/ (path resmi vendor Longhorn) — IP whitelist dihapus (keterbatasan teknis SNI di path bersama, keputusan sadar), Basic Auth dipertahankan. Domain lama redirect 301 Dimigrasikan — lihat Laporan Kerja
12 ACL IP whitelist Longhorn di HAProxy Ditambahkan 7 Juli (lihat #Web Security Longhorn) Ditemukan sudah hilang dari servers.cfg saat pengecekan 8 Juli — kena dampak insiden revert yang sama dengan Dashboard (#10) ℹ️ Tidak masalah — proteksi sudah direncanakan dihapus di migrasi #11
13 StorageClass longhorn-hdd Disebut sejak dokumen rencana awal (untuk data umum/backup, bukan storage DB) Ternyata tidak pernah benar-benar dibuat di cluster — baru ketahuan saat deployment Prometheus gagal dengan error "storage class does not exist" pada 8 Juli Dibuat (replika 2×, atas permintaan Admin) — lihat Instalasi Monitoring §2
14 ServiceMonitor/PodMonitor baru tidak muncul di Prometheus Tidak berlaku (fitur baru) Config Secret Prometheus Operator sudah benar diregenerasi, tapi Pod yang sedang berjalan tidak me-refresh mount Secret-nya (cache kubelet basi) — target baru tidak muncul sama sekali sampai Pod di-restart manual 🔧 Root cause ditemukan & diperbaiki — lihat Instalasi Monitoring §8

Ringkasan Kondisi Terkini (8 Juli 2026)

  • Platform K8s (RKE2, Cilium, MetalLB, Longhorn, Traefik): berjalan sehat
  • WireGuard VNF: diperbaiki, config stabil, belum ada client aktif memakainya
  • Longhorn UI & Kubernetes Dashboard: diekspos dengan HTTPS trusted ke domain masing-masing
  • Halaman utama oneke.ums.id: diarahkan ke demo-app (placeholder + navigasi)
  • Galera cluster (MariaDB) 3 node: berjalan sehat, backup terjadwal ke S3 aktif, failover teruji — lihat Instalasi MariaDB Galera
  • PostgreSQL + Patroni 3 node: berjalan berdampingan dengan Galera (namespace terpisah), synchronous_mode aktif, backup WAL-G + WAL archiving kontinu (PITR) ke S3, failover teruji — lihat Instalasi PostgreSQL + Patroni
  • Monitoring (Prometheus + Grafana): kube-prometheus-stack khusus oneKE berjalan sehat, mengumpulkan metrik Longhorn, Traefik, Patroni, dan Galera; Grafana diekspos di https://oneke.ums.id/grafana/ — lihat Instalasi Monitoring
  • Storage upload user: disk baru 512GB/node dari datastore OpenNebula image_hdd (101) ditambahkan ke 3 storage node, terisolasi dari disk database via StorageClass longhorn-uploads (diskSelector tag) — lihat Penambahan Storage Uploads
  • Monitor custom di homepage: widget status real-time (VM aktif, kesehatan aplikasi, pemakaian resource total/per-VM/per-aplikasi) tampil di https://oneke.ums.id/, didukung API custom status-api yang query Prometheus + Kubernetes API — lihat Monitor Custom di Homepage
  • Endpoint S3 khusus oneKE (oneke-s3.ums.id) dibangun di atas infrastruktur MinIO UMS yang sudah ada, terpisah dari bucket aplikasi lain
  • VM VNF & Master: .vscode-server sisa sesi lama (total ~4.2GB gabungan) dibersihkan, beberapa proses macet yang menghabiskan CPU/disk signifikan ikut dihentikan

Halaman ini dipelihara untuk menjaga konsistensi antar dokumen seiring cluster terus berkembang.