Depurar código usando Databricks Connect para a extensão do IDE Databricks

Este artigo descreve como usar a integração Databricks Connect na extensão do IDE Databricks para executar e depurar arquivos Python (.py) individuais. Para informações sobre a extensão, veja extensão do IDE Databricks.

A integração do Databricks Connect também permite que você execute e depure células do notebook. Consulte Executar e depurar células do notebook com o Databricks Connect usando a extensão Databricks IDE.

Requisitos

Antes de poder usar o Databricks Connect dentro da extensão do IDE do Databricks, você deve primeiro atender aos requisitos do Databricks Connect. Esses requisitos incluem coisas como um espaço de trabalho habilitado pelo Unity Catalog e requisitos de computação. Quando você configura seu ambiente Python usando a extensão, a versão correta do Python é instalada para você. Veja Configure seu ambiente Python e o Databricks Connect.

Configure seu ambiente Python e instale o Databricks Connect

Você pode usar a extensão para configurar facilmente um ambiente Python local que corresponda ao seu cálculo alvo. Ele constrói um local .venv (gerenciado por UV) cuja versão em Python e conjunto de pacotes correspondem à versão em tempo de execução ou serverless, e instala uma versão compatível do Databricks Connect como parte da configuração.

Na visualização de Configuração da extensão, clique em Configurar ambiente Python e selecione computar. Para detalhes, incluindo a alternativa à CLI do Azure Databricks, veja Configurar seu ambiente Python e Databricks Connect.

Após a instalação do Databricks Connect, se o botão vermelho desativado do Databricks Connect aparecer na barra de status do Visual Studio Code, clique nele e complete as instruções na tela para habilitá-lo. Quando o botão Databricks Connect ativado aparecer, você estará pronto para usar o Databricks Connect.

Observação

Se você usar o Poetry, poderá sincronizar seus arquivos pyproject.toml e poetry.lock com o pacote do Databricks Connect instalado (e suas dependências) executando o comando a seguir. Certifique-se de substituir 16.4.1 pela versão do pacote Databricks Connect que corresponde à instalada pela extensão IDE do Databricks para o seu projeto.

poetry add databricks-connect==16.4.1

Execute ou depure seu código Python

Depois de habilitar o Databricks Connect, execute ou depure seu arquivo Python (.py):

  1. Em seu projeto, abra o arquivo Python que você deseja executar ou depurar.

  2. Defina os pontos de interrupção de depuração no arquivo Python.

  3. Clique no ícone Executar no Databricks ao lado da lista de guias do editor e, em seguida, clique em Depurar arquivo atual com o Databricks Connect.

    Depurar o arquivo atual pelo ícone

    A saída aparece no painel Console de Depuração.

    Você também pode clicar com o botão direito do mouse no arquivo .py e, em seguida, clicar em Executar no Databricks>Depurar arquivo atual com o Databricks Connect.

    Depurar o arquivo atual no menu de contexto