Krav och begränsningar för Unity-katalogen

Den här sidan beskriver beräkningskraven, filformat som stöds, namngivningsbegränsningar och kända begränsningar för Unity Catalog.

Regionstöd

Alla regioner stöder Unity Catalog. Mer information finns i Azure Databricks-regioner.

Beräkningskrav

Unity Catalog stöds på kluster som kör Databricks Runtime 11.3 LTS eller senare. Unity Catalog stöds som standard i alla SQL Warehouse-beräkningsversioner .

Kluster som körs på tidigare versioner av Databricks Runtime har inte stöd för alla unity catalog GA-funktioner.

För att få åtkomst till data i Unity Catalog måste kluster konfigureras med rätt åtkomstläge. Unity Catalog är säker som standard. Om ett kluster inte har konfigurerats med standard- eller dedikerat åtkomstläge kan klustret inte komma åt data i Unity Catalog. Se Åtkomstlägen.

Detaljerad information om funktionsändringar i Unity Catalog i varje Databricks Runtime-version finns i viktig information.

Stöd för filformat

Unity Catalog stöder följande tabellformat:

Namngivningskrav för skyddsbara objekt

Följande begränsningar gäller för alla objektnamn i Unity Catalog:

  • Objektnamn får inte överstiga 255 tecken.
  • Följande specialtecken tillåts inte:
    • Period (.)
    • Blanksteg ( )
    • Snedstreck (/)
    • Alla ASCII-kontrolltecken (00–1F hex)
    • Tecken DELETE (7F hexadecimalt)
  • Unity Catalog lagrar alla objektnamn som små bokstäver.
  • När du refererar till UC-namn i SQL måste du använda backticks för att undkomma namn som innehåller specialtecken som bindestreck (-).

Note

Kolumnnamn kan använda specialtecken, men namnet måste omslutas med backticks i alla SQL-instruktioner om man använder specialtecken. Unity Catalog bevarar kolumnnamnshöljet, men frågor mot Unity Catalog-tabeller är skiftlägeskänsliga.

Begränsningar

Unity Catalog har följande begränsningar. Vissa av dessa är specifika för äldre Databricks Runtime-versioner och beräkningsåtkomstlägen.

Strukturerade strömningsarbetsbelastningar har ytterligare begränsningar, beroende på Databricks Runtime och åtkomstläge. Se Krav och begränsningar för standardberäkning ochdedikerade beräkningskrav och begränsningar.

Databricks släpper nya funktioner som krymper listan regelbundet.

  • Grupper som tidigare har skapats i en arbetsyta (dvs. grupper på arbetsytenivå) kan inte användas i Unity Catalog-instruktioner GRANT . Detta är för att säkerställa en konsekvent vy över grupper som kan sträcka sig över arbetsytor. Om du vill använda grupper i GRANT -instruktioner skapar du dina grupper på kontonivå och uppdaterar all automatisering för huvudkonto- eller grupphantering (till exempel SCIM-, Okta- och Microsoft Entra-ID-anslutningsappar och Terraform) för att referera till kontoslutpunkter i stället för arbetsyteslutpunkter. Se Gruppkällor.
  • Arbetsbelastningar i R stöder inte användning av dynamiska vyer för säkerhet på radnivå eller kolumnnivå vid beräkning som kör Databricks Runtime 15.3 och lägre.
    • Använd en dedikerad beräkningsresurs som kör Databricks Runtime 15.4 LTS eller senare för arbetsbelastningar i R som frågar dynamiska vyer. Sådana arbetsbelastningar kräver också en arbetsyta som är aktiverad för serverlös beräkning. Mer information finns i Detaljerad åtkomstkontroll för dedikerad beräkning.
  • En hanterad tabell kan ytligt klonas till en annan hanterad tabell som går på Databricks Runtime 13.3 LTS och senare. En extern tabell kan ytligt klonas till en annan extern tabell på Databricks Runtime 14.2 och senare. En hanterad tabell kan inte klonas ytligt till en extern tabell. En extern tabell kan inte heller ytklonas till en hanterad tabell. Mer information finns i Shallow clone for Unity Catalog tables.
  • Bucketing stöds inte för Unity Catalog-tabeller. Om du kör kommandon som försöker skapa en bucketad tabell i Unity Catalog utlöser det ett undantag.
  • Att skriva till samma sökväg eller Delta Lake-tabell från arbetsytor i flera regioner kan leda till otillförlitliga prestanda om vissa kluster har åtkomst till Unity Catalog och andra inte.
  • Att manipulera partitioner för externa tabeller med hjälp av kommandon som ALTER TABLE ADD PARTITION kräver att loggning av partitionsmetadata aktiveras. Se Partitionsidentifiering för externa tabeller.
  • När du använder överskrivningsläge för tabeller som inte är i Delta-format måste användaren ha CREATE TABLE behörighet för det överordnade schemat och måste vara ägare till det befintliga objektet ELLER ha behörigheten ÄNDRA för objektet.
  • Python-UDF:er stöds inte i Databricks Runtime 12.2 LTS och nedan. Detta inkluderar UDAFs, UDTF:er och Pandas på Spark (applyInPandas och mapInPandas). Python-skalära UDF:er stöds i Databricks Runtime 13.3 LTS och senare.
  • Scala-UDF:er stöds inte i Databricks Runtime 14.1 och lägre vid beräkning med standardåtkomstläge. Skalära UDF:er stöds i Databricks Runtime 14.2 och senare vid beräkning med standardåtkomstläge.
  • Standard Scala-trådpooler stöds inte. Använd i stället de särskilda trådpoolerna i org.apache.spark.util.ThreadUtils, till exempel org.apache.spark.util.ThreadUtils.newDaemonFixedThreadPool. Följande trådpooler i ThreadUtils stöds dock inte: ThreadUtils.newForkJoinPool och alla ScheduledExecutorService trådpooler.
  • Azure-diagnostikloggar loggar endast Unity Catalog-händelser på arbetsytenivå. Om du vill visa åtgärder på kontonivå måste du använda systemtabellen för granskningsloggar. Se referens till systemtabell för granskningslogg.

Modeller som är registrerade i Unity Catalog har ytterligare begränsningar. Se Begränsningar.

Resurskvoter

Unity Catalog tillämpar resurskvoter på alla skyddbara objekt. Dessa kvoter visas i Resursgränser. Om du förväntar dig att överskrida dessa resursgränser kontaktar du ditt Azure Databricks-kontoteam.

Du kan övervaka din kvotanvändning med hjälp av API:erna för Enhetskatalogens resurskvoter. Se Övervaka din användning av Unity Catalog-resurskvoter.