Azure Databricks でコンピューティングを選択して構成する

中級
データ エンジニア
Azure Databricks

Azure Databricks には、さまざまなワークロード用に最適化された複数のコンピューティング オプションが用意されています。 このモジュールでは、適切なコンピューティングの種類の選択、パフォーマンス設定の構成、アクセス許可の管理、ライブラリのインストールを行う方法について説明します。 サーバーレスコンピューティングとクラシック コンピューティングのどちらを使用するか、コストとパフォーマンスのためにクラスターを最適化する方法、コンピューティング リソースをセキュリティで保護するためのベスト プラクティスについて説明します。

学習の目的

このモジュールを終了すると、次のことができるようになります。

  • さまざまな Azure Databricks ワークロードに適したコンピューティングの種類を選択する
  • ノードの種類、自動スケール、終了などのコンピューティング パフォーマンス設定を構成する
  • Photon アクセラレーションなどのコンピューティング機能を有効にし、適切な Databricks Runtime バージョンを選択する
  • コンピューティング アクセス許可と専用グループ アクセス モードを構成する
  • さまざまな方法を使用してコンピューティング リソースにライブラリをインストールおよび管理する

前提条件

次の前提条件を満たす必要があります。

  • Azure Databricks の概念の基本的な理解
  • Unity カタログとワークスペースの管理に関する知識
  • Spark の基礎とクラスター アーキテクチャに関する知識