Использование Apache Spark в Azure Databricks

Средний уровень
Инженер по анализу и обработке данных
Azure Databricks

Azure Databricks основан на Apache Spark и позволяет инженерам и аналитикам выполнять задания Spark для преобразования, анализа и визуализации данных в масштабе.

Цели обучения

В этом модуле вы узнаете, как:

  • описание ключевых элементов архитектуры Apache Spark;
  • создание и настройка кластера Spark;
  • описание вариантов использования Spark;
  • использование Spark для обработки и анализа хранимых данных в файлах;
  • визуализация данных с помощью Spark.

Предварительные требования

Прежде чем начать этот модуль, у вас должны быть базовые знания о Azure Databricks. Прежде чем использовать этот модуль, рассмотрите возможность изучения модуля Azure Databricks .