Databricks Sandbox

Important

Deze functie bevindt zich in de bètaversie. Om de preview van deze functie in de werkruimte in te schakelen, meld je je aan voor de Databricks Sandbox-instelling op de pagina Previews van de werkruimte. Zie Azure Databricks previews beheren.

Databricks rekent momenteel geen kosten voor het gebruik van deze functie. Echter, kosten en prijzen voor functies in de bèta kunnen veranderen.

Databricks Sandbox laat je onvertrouwde code uitvoeren in een geïsoleerde omgeving via de Databricks REST API, SDK of Databricks CLI. De sandbox biedt serverless, on-demand rekenkracht om code dynamisch uit te voeren.

Elke sandbox bevat een permanente basismap. Je kunt een sandbox op elk moment stoppen en starten, en de gegevens in je thuismap blijven behouden.

De sandbox is ideaal voor:

  • Een agentenharnas gebruiken.
  • Het uitvoeren van door de gebruiker geschreven of door AI geschreven code.
  • Achtergrondtaken uitvoeren of werknemers.
  • Interactieve IDE- of SSH-sessies starten.

Prerequisites

Quickstart

Begin met het maken van een sandbox met een paar regels code:

from databricks.sdk import WorkspaceClient
from databricks.sdk.service.sandbox import Sandbox

w = WorkspaceClient()

created = w.sandbox.create_sandbox(
    sandbox=Sandbox(),
    sandbox_id="my-sandbox",
)
print(created.name)   # "sandboxes/my-sandbox"

Voor een volledige walkthrough over het maken van een sandbox, het uitvoeren van commando's erin en het beheren van de levenscyclus, zie Create and manage sandboxes with the SDK.

Grootte berekenen

Databricks Sandbox wordt geleverd met 4 vCPU's en 8 GB RAM. Deze maat is niet configureerbaar.

Storage

Warning

Aan het einde van de bètaperiode kunnen Databricks een eenmalige zuivering uitvoeren van gegevens die in sandboxes zijn opgeslagen. Bewaar niets wat je je niet kunt veroorloven te verliezen.

Databricks Sandbox wordt geleverd met netwerkopslag.

  • Data in je thuismap (/home/sandbox-agent) blijft gedurende de levensduur van je Databricks Sandbox bestaan. Zelfs nadat je je Databricks Sandbox hebt gestopt, is de data in je thuismap beschikbaar wanneer je je volgende sessie start.
  • Je persoonlijke map biedt ruimte voor maximaal 100 GB. Op dit moment kan dit niet worden veranderd.
  • Je kunt tot 10 GB buiten je thuismap opslaan, maar deze gegevens worden verwijderd zodra je je sandbox stopt.

Networking

Er zijn geen beperkingen op netwerkuitgang vanuit een sandbox, en uitgang is niet configureerbaar.

Gebruikskosten

Voor volledige informatie over het factureringsgebruik, zie Databricks-prijsstelling. Databricks verwacht het gebruik van de sandbox in rekening te brengen voor:

  • Runtime-rekenkracht: Per uur gefactureerd zolang je Databricks Sandbox actief is.
  • Persistente opslag: Je wordt gefactureerd voor de gegevens die in je thuismap zijn opgeslagen totdat je Databricks Sandbox is verwijderd. Storage brengt facturering met zich mee zolang de Databricks Sandbox-instantie bestaat. Om te stoppen met het betalen voor opslag, moet je de sandbox verwijderen.
  • Dataoverdracht

De Databricks SDK voor Python is de aanbevolen manier om toegang te krijgen tot de sandbox. Zie de Databricks SDK voor Python sandbox-referentie voor beschikbare commando's, en Create and manage sandboxes with the SDK voor voorbeelden.

Toegang tot de sandbox via CLI

Je kunt ook je sandbox via SSH benaderen. Dit is handig voor langere agenttaken zonder dat je lokale machine actief hoeft te blijven. U kunt bijvoorbeeld het volgende doen:

  • Stuur je codeeragent rechtstreeks vanuit de Databricks CLI via SSH.
  • Verbind een desktop-IDE of een agent-harnas zoals Cursor, Claude of Codex.

Om een sandbox te maken en ermee te verbinden via de Databricks CLI, voer je uit:

databricks sandbox create      # create your sandbox
databricks sandbox register    # optional: register SSH keys
databricks sandbox ssh         # SSH to your default sandbox

Wanneer je via SSH naar je sandbox gaat, wordt de Databricks CLI geïnstalleerd en geauthenticeerd met de Databricks-werkruimte waar je sandbox draait. Je kunt ook Git-inloggegevens configureren. Zie Uw Git-provider verbinden met Databricks.

Voor gedetailleerde commandohulp, start databricks sandbox -h, of zie sandbox command group.

Wanneer je voor het eerst via SSH verbinding maakt met je sandbox, configureert Databricks automatisch gangbare codeerhulpmiddelen zoals Claude en Codex voor het gebruik van AI Gateway als AI Gateway is geconfigureerd voor je werkruimte. Voor meer informatie, zie Create and manage model APIs (model services).

Beheerde Omnigent

Managed Omnigent gebruikt Databricks Sandbox als uitvoeringsbackend. Voor meer informatie, zie Omnigent op Databricks.

Limitations

  • Quota worden gehandhaafd. Je kunt maximaal 40 actieve sandboxes per gebruiker hebben (400 in totaal in alle staten), en een werkruimte kan maximaal 100 actieve sandboxes hebben (in totaal 1.000).
  • Databricks Sandbox is een rekenprimitief voor het draaien van code, geen algemene Spark-runtime. Voor Spark-workloads gebruik je Connect to serverless compute.
  • De publieke IP-adressen van je Databricks Sandbox kunnen op elk moment veranderen. De standaard ingang van de sandbox is gesloten voor al het verkeer. Dit kan op dit moment niet worden veranderd.
  • Je kunt je omgeving niet aanpassen bij het opstarten of een omgeving buiten je thuismap behouden. Om pakketten of configuraties over sessies heen te hergebruiken, sla je ze op in je thuismap.