Wybieranie i konfigurowanie obliczeń w usłudze Azure Databricks

Średni
Inżynier danych
Azure Databricks

Usługa Azure Databricks oferuje wiele opcji obliczeniowych zoptymalizowanych pod kątem różnych obciążeń. W tym module opisano sposób wybierania odpowiedniego typu obliczeniowego, konfigurowania ustawień wydajności, zarządzania uprawnieniami dostępu i instalowania bibliotek. Dowiesz się, kiedy używać obliczeń bezserwerowych i klasycznych, jak zoptymalizować klastry pod kątem kosztów i wydajności oraz najlepsze rozwiązania dotyczące zabezpieczania zasobów obliczeniowych.

Cele szkolenia

Po ukończeniu tego modułu będziesz wiedzieć, jak wykonać następujące czynności:

  • Wybieranie odpowiednich typów obliczeniowych dla różnych obciążeń usługi Azure Databricks
  • Konfigurowanie ustawień wydajności obliczeniowej, w tym typów węzłów, skalowania automatycznego i kończenia
  • Włącz funkcje obliczeniowe, takie jak przyspieszanie Photon, i wybierz odpowiednie wersje środowiska Databricks Runtime
  • Konfigurowanie uprawnień dostępu do zasobów obliczeniowych i trybów dostępu dedykowanej grupy
  • Instalowanie bibliotek obliczeniowych i zarządzanie nimi przy użyciu różnych metod

Wymagania wstępne

Należy wykonać następujące wymagania wstępne:

  • Podstawowa wiedza na temat pojęć związanych z usługą Azure Databricks
  • Znajomość zarządzania katalogiem Unity oraz zarządzania obszarem roboczym
  • Znajomość podstaw platformy Spark i architektury klastra