Azure Managed Instance untuk Model Tanggung Jawab Bersama Apache Cassandra

Pendahuluan

Dokumen ini mendefinisikan pembagian tanggung jawab antara Microsoft dan pelanggan saat menggunakan Azure Managed Instance untuk Apache Cassandra (Cassandra MI).

Tujuannya adalah untuk memberikan kejelasan tentang:

  • Batas kepemilikan operasional
  • Ekspektasi performa dan ketersediaan
  • Tanggung jawab keamanan dan kepatuhan

Penting

  • Tidak ada SLA latensi. Performa tergantung pada SKU yang Anda pilih dan karakteristik beban kerja.
  • Microsoft menjamin waktu aktif proses Cassandra, bukan performa tingkat API atau latensi kueri.
  • Masalah yang disebabkan oleh saturasi sumber daya (CPU, disk, memori, jaringan) harus diselidiki dan dimitigasi oleh pelanggan. Microsoft menyediakan metrik dan log untuk mendukung analisis ini.

tanggung jawab Microsoft

Microsoft mengoperasikan dan mengelola infrastruktur yang mendasar untuk Cassandra MI. Tanggung jawab ini meliputi:

Infrastruktur dan platform

  • Penyediaan kluster, pusat data, dan node Cassandra
  • Manajemen sistem operasi, patching, dan pembaruan keamanan
  • Manajemen siklus hidup infrastruktur perangkat keras dan host
  • Isolasi jaringan dengan menggunakan Azure Virtual Networks (VNets)

Ketersediaan dan SLA

  • Ketersediaan yang didukung SLA hanya untuk pusat data produksi
  • SLA berlaku untuk:
    • OS
    • Proses Cassandra
    • Kegagalan perangkat keras
  • SLA tidak mencakup:
    • Kelelahan sumber daya (CPU, disk, memori, jaringan)
    • Kegagalan tingkat aplikasi atau kueri
  • Tidak ada SLA untuk:
    • Kluster atau pusat data non-produksi atau yang alokasinya dibatalkan

Penskalakan dan penerapan versi

  • Penskalakan simpul (menambahkan atau menghapus node) yang dipicu melalui portal Azure atau API
  • Ketersediaan versi Cassandra baru setelah rilis OSS stabil
  • Penghapusan versi yang tidak digunakan lagi dari opsi provisi

Keamanan dan enkripsi

  • Enkripsi saat tidak aktif dan saat transit
  • Manajemen dan rotasi sertifikat untuk TLS atau SSL
  • Pemindaian dan remediasi kerentanan berkelanjutan

Pemantauan dan dukungan

  • Integrasi dengan Azure Monitor untuk log dan metrik
  • Peringatan proaktif untuk gangguan pada tingkat platform
  • Analisis akar masalah (RCA) untuk insiden platform yang berdampak pada produksi

Pencadangan dan pemulihan

  • Pencadangan online otomatis berdasarkan preferensi jadwal dan retensi Anda
  • Pemulihan cadangan melalui permintaan dukungan

Note

  • Customer Managed Keys (CMK) didukung untuk data tidak aktif.
  • CMK saat ini tidak didukung untuk pencadangan.

Tanggung jawab pelanggan

Anda bertanggung jawab atas semua data, skema, dan operasi tingkat aplikasi.

Pemodelan data dan desain kueri

  • Merancang kunci partisi dan model data yang optimal
  • Menghindari partisi panas dan kueri yang tidak efisien
  • Penalaan kueri dan pengoptimalan kinerja

Skema dan konfigurasi

  • Mengelola keyspace, faktor replikasi, dan tingkat konsistensi
  • Melakukan perubahan skema
  • Menyetel strategi pemadatan dan pengumpulan sampah (GC)
  • Mengesampingkan konfigurasi Cassandra default jika diperlukan

Performa dan pemantauan

  • Pemantauan:

    • Penggunaan CPU
    • Penggunaan memori
    • Penggunaan disk
    • IOPS dan throughput
  • Menyelidiki latensi dengan menggunakan:

    • Azure Monitor
    • Prometheus
    • Metrik Cassandra
  • Mengambil tindakan korektif dan pencegahan

Perencanaan kapasitas

  • Merencanakan throughput dan pertumbuhan kapasitas penyimpanan
  • Menskalakan pusat data ke atas atau ke bawah sesuai kebutuhan

Note

Batasan penskalaan penyimpanan Anda tidak dapat langsung mengubah ukuran disk. Untuk mengubah ukuran disk, Anda harus:

  • Membuat pusat data baru dengan ukuran disk yang diinginkan
  • Memigrasikan beban kerja

Peningkatan versi

  • Memulai peningkatan utama dan minor (misalnya, Cassandra 3.x → 5.x)
  • Memvalidasi kompatibilitas aplikasi sebelum peningkatan

Note

Anda bertanggung jawab atas terjadinya waktu henti karena versi yang sudah usang atau tidak didukung lagi.

Strategi pencadangan

  • Tentukan jadwal pencadangan dan kebijakan penyimpanan.
  • Menerapkan strategi pemulihan bencana (DR)

Jaringan

  • Konfigurasi:

    • VNet, subnet, dan NSG
    • Penyelesaian DNS
    • Peraturan firewall
  • Penyiapan:

    • VPN / ExpressRoute (jika hibrid)

Keamanan dan akses

  • Mengelola pengguna dan peran database
  • Menerapkan enkripsi tingkat aplikasi (jika diperlukan)
  • Memastikan kepatuhan terhadap persyaratan peraturan

Operations

  • Menangani masalah tingkat aplikasi:

    • Batas waktu kueri
    • Akumulasi batu nisan
    • Inkonsistensi data
  • Menggunakan alat yang disetujui (tidak ada akses SSH/JMX)

  • Meninjau log dan bertindak berdasarkan anomali


Tanggung Jawab Bersama

Beberapa area memerlukan kolaborasi antara Microsoft dan pelanggan:

Pemantauan keamanan

  • Microsoft menyediakan log dan telemetri
  • Pelanggan harus:
    • Meninjau peringatan
    • Menyelidiki anomali
    • Mengambil tindakan korektif

Note

Jika mTLS (TLS bersama) digunakan:

  • Siklus hidup dan perpanjangan sertifikat sisi klien adalah tanggung jawab pelanggan

Penyebaran hibrid

  • Microsoft mengelola simpul yang dihosting Azure
  • Pelanggan mengelola simpul Cassandra lokal
  • Konektivitas antar lingkungan adalah tanggung jawab bersama

Compliance

  • Microsoft memastikan kepatuhan tingkat platform
  • Pelanggan memiliki:
    • Kepatuhan tingkat aplikasi
    • Kebijakan tata kelola data

Panduan konfigurasi

Pelanggan diharapkan untuk mengikuti konfigurasi yang direkomendasikan Microsoft, termasuk:

  • Aturan jaringan keluar yang diperlukan
  • Praktik terbaik keamanan dan jaringan

Matriks tanggung jawab

Tugas Microsoft Customer
Penyediaan infrastruktur & manajemen
Pembaruan patch OS & Cassandra
Pencadangan (dikelola oleh platform)
Penjadwalan cadangan jangka panjang
Desain & pengoptimalan model data
Peningkatan versi
Konfigurasi jaringan
Pemantauan & peninjauan peringatan
Kepatuhan & tata kelola
Ketersediaan (platform SLA)
Keamanan

Alternatif: Azure Cosmos DB untuk API NoSQL

Azure Cosmos DB (NoSQL API) adalah alternatif cloud-native yang dikelola sepenuhnya dengan manfaat tambahan:

Benefit Deskripsi
Ketersediaan SDK Asli SDK untuk Java, .NET, Python, Node.js
Dukungan Kelas Perusahaan Dukungan Microsoft 24×7 dengan jalur eskalasi
Pengalaman Terkelola Penuh Penambalan otomatis, pencadangan, kepatuhan
Jaminan <Latensi 10 ms, ketersediaan 99,999%, jaminan konsistensi, lihat perjanjian tingkat layanan Azure
Keamanan & Kepatuhan Terintegrasi Enkripsi, identitas, sertifikasi kepatuhan global
Distribusi Global & Skala Otomatis Replikasi multi-wilayah dan penskalaan otomatis