Artikel ini mencantumkan jawaban atas tanya jawab umum tentang pengaturan administrasi ruang kerja Apache Spark.
Bagaimana cara menggunakan peran RBAC untuk mengonfigurasi pengaturan ruang kerja Spark saya?
Gunakan menu Kelola Akses untuk menambahkan izin Admin untuk pengguna, grup distribusi, atau grup keamanan tertentu. Anda juga dapat menggunakan menu ini untuk membuat perubahan pada ruang kerja dan memberikan akses untuk menambahkan, memodifikasi, atau menghapus pengaturan ruang kerja Spark.
Apakah perubahan yang dilakukan pada properti Spark di tingkat lingkungan berlaku untuk sesi notebook aktif atau pekerjaan Spark terjadwal?
Saat Anda membuat perubahan konfigurasi di tingkat ruang kerja, perubahan tersebut tidak diterapkan ke sesi Spark aktif. Ini termasuk sesi berbasis batch atau notebook. Anda harus memulai buku catatan baru atau sesi batch setelah menyimpan pengaturan konfigurasi baru agar pengaturan diterapkan.
Dapatkah saya mengonfigurasi properti keluarga node, runtime Spark, dan Spark pada tingkat kapasitas?
Ya, Anda dapat mengubah runtime, atau mengelola properti spark menggunakan pengaturan Rekayasa Data/Sains sebagai bagian dari halaman pengaturan admin kapasitas. Anda memerlukan akses admin kapasitas untuk melihat dan mengubah pengaturan kapasitas ini.
Bisakah saya memilih keluarga simpul yang berbeda untuk notebook dan definisi kerja Spark yang berbeda di ruang kerja saya?
Saat ini, Anda hanya dapat memilih keluarga simpul berbasis Memori yang Dioptimalkan untuk seluruh ruang kerja.
Bisakah saya mengonfigurasi pengaturan ini di tingkat buku catatan?
Ya, Anda bisa menggunakan %%configure untuk mengkustomisasi properti di tingkat sesi Spark di Notebooks
Dapatkah saya mengonfigurasi jumlah minimum dan maksimum simpul untuk keluarga simpul yang dipilih?
Ya, Anda dapat memilih node min dan maks berdasarkan batas ledakan maks yang diizinkan dari kapasitas Fabric yang ditautkan ke ruang kerja Fabric.
Dapatkah saya mengaktifkan Penskalaan Otomatis untuk Kumpulan Spark dalam memori yang dioptimalkan atau keluarga simpul berbasis GPU yang dipercepat perangkat keras?
Penskalaan otomatis tersedia untuk kumpulan Spark dan mengaktifkan yang memungkinkan sistem untuk secara otomatis meningkatkan komputasi berdasarkan tahap pekerjaan selama runtime. GPU saat ini tidak tersedia. Kemampuan ini akan diaktifkan dalam rilis mendatang.
Apakah Penembolokan Cerdas untuk Kumpulan Spark didukung atau diaktifkan secara default untuk ruang kerja?
Penembolokan Cerdas diaktifkan secara default untuk kumpulan Spark untuk semua ruang kerja.