Databricks Sandbox

Importante

Esse recurso está em Beta. Para habilitar essa pré-visualização no workspace, opte pela configuração Databricks Sandbox na página de Pré-visualizações do workspace. Consulte Gerenciar visualizações do Azure Databricks.

Atualmente, a Databricks não cobra pelo uso desse recurso. No entanto, o custo e o preço dos recursos no Beta podem ser alterados.

O Databricks Sandbox permite que você execute código não confiável em um ambiente isolado através da API REST, SDK ou CLI do Databricks. O sandbox oferece computação sem servidor, sob demanda, para rodar código dinamicamente.

Cada sandbox inclui um diretório doméstico persistente. Você pode parar e iniciar um sandbox a qualquer momento, e os dados no seu diretório pessoal permanecem.

O sandbox é ideal para:

  • Executando um ambiente de agentes.
  • Executar código escrito por usuários ou IA.
  • Rodando tarefas ou trabalhadores em segundo plano.
  • Lançamento de sessões interativas de IDE ou SSH.

Pré-requisitos

Início Rápido

Comece criando um sandbox com algumas linhas de código:

from databricks.sdk import WorkspaceClient
from databricks.sdk.service.sandbox import Sandbox

w = WorkspaceClient()

created = w.sandbox.create_sandbox(
    sandbox=Sandbox(),
    sandbox_id="my-sandbox",
)
print(created.name)   # "sandboxes/my-sandbox"

Para um guia completo sobre como criar um sandbox, executar comandos nele e gerenciar seu ciclo de vida, veja Criar e gerenciar sandboxes com o SDK.

Tamanho da computação

O Databricks Sandbox vem com 4 vCPUs e 8 GB de RAM. Esse tamanho não é configurável.

Armazenamento

Warning

Ao final do período Beta, os Databricks podem realizar uma purga única dos dados armazenados em sandboxes. Não guarde nada que você não possa se dar ao luxo de perder.

O Databricks Sandbox vem com armazenamento conectado à rede.

  • Os dados no seu diretório inicial (/home/sandbox-agent) persistem durante toda a vida útil do seu Databricks Sandbox. Mesmo após parar o Databricks Sandbox, os dados no seu diretório pessoal estarão disponíveis quando você iniciar sua próxima sessão.
  • Seu diretório doméstico pode armazenar até 100 GB. Neste momento, isso não pode ser mudado.
  • Você pode armazenar até 10 GB fora do seu diretório principal, mas esses dados são excluídos quando você para o sandbox.

Rede

Não há restrições sobre saída de rede a partir de um sandbox, e a saída não é configurável.

Custos de uso

Para obter informações completas sobre o uso relacionado ao faturamento, consulte Preços do Databricks. Databricks prevê cobrar pelo uso do sandbox para:

  • Computação em execução: Cobrada por hora enquanto seu Databricks Sandbox estiver em execução.
  • Armazenamento persistente: Você é cobrado pelos dados armazenados no seu diretório inicial até que seu Databricks Sandbox seja excluído. O armazenamento gera cobrança enquanto a instância Sandbox do Databricks existir. Para parar de pagar pelo armazenamento, você deve deletar o sandbox.
  • Transferência de dados

O SDK Databricks para Python é a forma recomendada de acessar o sandbox. Consulte a referência do sandbox do SDK da Databricks para Python para ver os comandos disponíveis e Criar e gerenciar sandboxes com o SDK para ver exemplos.

Acesse o sandbox via CLI

Você também pode acessar seu sandbox via SSH. Isso é útil para executar tarefas de agente mais longas sem precisar que sua máquina local permaneça ativa. Por exemplo, você pode:

  • Conduza seu agente de codificação diretamente da CLI Databricks via SSH.
  • Conecte um IDE desktop ou um harness de agentes, como Cursor, Claude ou Codex.

Para criar um sandbox e conectar-se a ele com a CLI Databricks, execute:

databricks sandbox create      # create your sandbox
databricks sandbox register    # optional: register SSH keys
databricks sandbox ssh         # SSH to your default sandbox

Quando você entra em SSH no seu sandbox, a CLI do Databricks é instalada e autenticada no workspace do Databricks onde o sandbox está rodando. Você também pode querer configurar credenciais do Git. Consulte Conectar seu provedor Git ao Databricks.

Para ajuda detalhada com comandos, execute databricks sandbox -hou veja sandbox o grupo de comandos.

Quando você acessa seu sandbox pela primeira vez via SSH, o Databricks configura automaticamente ferramentas de programação comuns, como Claude e Codex, para usar o AI Gateway, caso ele esteja configurado no seu espaço de trabalho. Para mais informações, veja Criar um serviço de modelo personalizado .

Omnigent gerenciado

O Omnigent Gerenciado usa o Sandbox do Databricks como backend de execução. Para mais informações, consulte Omnigent no Databricks.

Limitations

  • As cotas são aplicadas. Você pode ter no máximo 40 sandboxes ativas por usuário (400 no total em todos os estados), e um workspace pode ter no máximo 100 sandboxes ativas (1.000 no total).
  • Databricks Sandbox é uma primitiva de computação para execução de código, não um runtime geral do Spark. Para cargas de trabalho do Spark, use Conectar-se à computação sem servidor.
  • Os endereços IP públicos do seu Databricks Sandbox podem mudar a qualquer momento. O acesso padrão do sandbox é fechado para todo tráfego. Isso não pode ser mudado no momento.
  • Você não pode personalizar seu ambiente na inicialização nem manter um ambiente fora do seu diretório doméstico. Para reutilizar pacotes ou configurações entre sessões, armazene-os no seu diretório home.