Megjegyzés
Az oldalhoz való hozzáféréshez engedély szükséges. Megpróbálhat bejelentkezni vagy módosítani a címtárat.
Az oldalhoz való hozzáféréshez engedély szükséges. Megpróbálhatja módosítani a címtárat.
A kiszolgáló nélküli folyamatok Azure Databricks felügyelt számításon futnak, így a legtöbb infrastruktúra-konfiguráció megszűnik.
A Databricks azt javasolja, hogy új folyamatokat fejlessz ki kiszolgáló nélküli használatával. Egyes számítási feladatokhoz a klasszikus számítás konfigurálása vagy az örökölt Hive-metaadattár használata szükséges. A két számítási típus egymás mellett összehasonlításához lásd: Szerver nélküli vs. klasszikus számítás a pipeline-ekhez. Lásd még: A klasszikus számítás konfigurálása folyamatokhoz és Lakeflow-folyamatok használata örökölt Hive-metastore-ral.
Megjegyzés:
- A kiszolgáló nélküli folyamatok mindig a Unity Katalógust használják. Lásd: A Unity-katalógus használata csővezetékekkel
- A kiszolgáló nélküli számítási korlátozásokért lásd kiszolgáló nélküli számítási korlátozásokat. Az itt ismertetett strukturált streamelési eseményindító-korlátozások nem vonatkoznak a folyamat módjaira. A kiszolgáló nélküli folyamatok támogatják az aktivált, folyamatos és valós idejű módokat. Lásd: Indított és folyamatos folyamatmód.
- Kiszolgáló nélküli folyamatok JSON-konfigurációjában nem adhat hozzá manuálisan számítási beállításokat egy
clustersobjektumhoz. Ha megkísérli ezt megtenni, az hibát eredményez.
- Ha Azure Private Link kapcsolatot kell használnia a kiszolgáló nélküli Lakeflow-folyamatokkal, forduljon a Databricks-képviselőhöz.
Requirements
- A munkaterületen engedélyezve kell lennie a Unity Catalognak a kiszolgáló nélküli folyamatok használatához.
Kiszolgáló nélküli folyamatok ajánlott konfigurációja
Fontos
A szerver nélküli pipeline-ek konfigurálásához nincs szükség fürtlétrehozási engedélyre. Alapértelmezés szerint minden munkaterület-felhasználó használhat kiszolgáló nélküli folyamatokat.
A kiszolgáló nélküli folyamatok eltávolítják a legtöbb konfigurációs lehetőséget, mivel Azure Databricks kezeli az összes infrastruktúrát. Új folyamat létrehozásakor az alapértelmezett beállítás a kiszolgáló nélküli használat. A kiszolgáló nélküli folyamatok konfigurálásáról további információt a folyamatok konfigurálása című témakörben talál.
A Unity Katalógusban konfigurált meglévő folyamatokat kiszolgáló nélkülire is konvertálhatja. Lásd: Meglévő folyamat átalakítása kiszolgáló nélkülihasználatára.
Egyéb konfigurációs szempontok
A kiszolgáló nélküli folyamatokhoz a következő konfigurációs beállítások is elérhetők:
- A folyamatos csővezeték üzemmódot is használhatja, amikor éles üzemben futtatja a csővezetékeket. Lásd: Indított és folyamatos folyamatmód.
- Adjon hozzá értesítéseket az e-mail-frissítésekhez a sikeres vagy sikertelen feltételek alapján. Lásd: E-mail-értesítések hozzáadása folyamateseményekhez.
- A Konfiguráció mezőben állítsa be a folyamat kulcs-érték párjait. Ezek a konfigurációk két célt szolgálnak:
- Állítsa be a forráskódban hivatkozható tetszőleges paramétereket. Lásd: Paraméterek használata csővezetékekkel.
- Konfigurálja a folyamatbeállításokat és a Spark-konfigurációkat. Lásd : Folyamattulajdonságok referenciája.
- A Preview csatornával tesztelheti folyamatát a függőben lévő futtatókörnyezeti változásokkal, és kipróbálhatja az új funkciókat.
- Deklarálja a külső Python függőségeket a folyamat környezeti beállításain keresztül. A Python folyamat (
dbutils.library.restartPython()) manuális újraindítása nem támogatott, így futásidőben nem telepíthet vagy tölthet újra függőségeket. Lásd: Folyamatok Python-függőségeinek kezelése.
Kiszolgáló nélküli használati szabályzat
Fontos
Ez a funkció nyilvános előzetes verzióban van.
A kiszolgáló nélküli használati szabályzatok lehetővé teszik a szervezet számára, hogy egyéni címkéket alkalmazzanak a kiszolgáló nélküli használatra a részletes számlázási hozzárendeléshez. Miután bejelölte a Kiszolgáló nélküli jelölőnégyzetet, megjelenik a Használati szabályzat beállítás, ahol kiválaszthatja a folyamatra alkalmazni kívánt szabályzatot. A címkéket a kiszolgáló nélküli használati szabályzat örökli, és csak a munkaterület rendszergazdái szerkeszthetik.
Megjegyzés:
Miután hozzárendelt egy kiszolgáló nélküli használati szabályzatot, a meglévő folyamatok nem lesznek automatikusan címkézve a szabályzattal. Ha csővezetékekhez (pipelines) szeretne szabályzatot csatolni, manuálisan kell frissítenie a meglévőket.
A kiszolgáló nélküli használati szabályzatokkal kapcsolatos további információkért lásd: Attribútumhasználat kiszolgáló nélküli használati szabályzatokkal.
Teljesítmény mód kiválasztása
Aktivált folyamatok esetén a folyamatütemező teljesítményoptimalizált beállításával kiválaszthatja a kiszolgáló nélküli számítási teljesítményt. Ha ez a beállítás le van tiltva, a folyamat szabványos teljesítménymódot használ. A standard teljesítmény mód úgy lett kialakítva, hogy csökkentse a számítási feladatok költségeit, ahol elfogadható a valamivel magasabb indítási késés. A standard teljesítménymódot használó kiszolgáló nélküli számítási feladatok általában az aktiválás után négy-hat percen belül kezdődnek, a számítási rendelkezésre állástól és az optimalizált ütemezéstől függően.
Ha a teljesítményoptimalizált teljesítmény engedélyezve van, a folyamat teljesítményre van optimalizálva, ami gyorsabb indítást és végrehajtást eredményez az időérzékeny számítási feladatokhoz.
Mindkét mód ugyanazt az termékváltozatot használja, de a standard teljesítménymód kevesebb dbU-t használ fel, ami alacsonyabb számítási használatot tükröz.
Megjegyzés:
A szabványos teljesítménymód folyamatos folyamattal való használatához futtassa a folyamatot folyamatos feladattal, és törölje a jelölést az ütemezésben található Performance optimized jelölőnégyzetből. Lásd: Futtass folyamatos folyamatot folyamatos feladattal és Ütemezz egy folyamatot a folyamat felhasználói felületén.
Kiszolgáló nélküli folyamatfunkciók
A konfiguráció egyszerűsítése mellett a kiszolgáló nélküli folyamatok a következő funkciókkal rendelkeznek:
- Materializált nézetek növekményes frissítése: A materializált nézetek frissítései lehetőség szerint növekményesen történik. A növekményes frissítés eredménye megegyezik a teljes újraszámítás eredményével. A frissítés teljes frissítést használ, ha az eredményeket nem lehet növekményesen kiszámítani. Lásd a növekményes frissítést a materializált nézetekhez.
- Adatfolyam csővezetékbe szervezése: A streamelési adatterhelések (például az adatbetöltés) kihasználtságának, átviteli sebességének és késésének javítása érdekében a mikrocsomagok csővezetékbe szervezve vannak . Más szóval ahelyett, hogy a standard Spark Structured Streaminghez hasonló mikrobacsokat futtat, a kiszolgáló nélküli Lakeflow-folyamatok egyszerre futtatnak mikrobacsokat, így javítva a számítási erőforrások kihasználtságát. A streamcsövezés alapértelmezés szerint engedélyezve van a kiszolgáló nélküli folyamatokban.
- Vertikális automatikus skálázás: a kiszolgáló nélküli Lakeflow-folyamatok hozzáadódnak a Databricks által biztosított horizontális automatikus skálázáshoz, mivel automatikusan kiosztják a legköltséghatékonyabb példánytípusokat, amelyek memóriakihasználtság miatti hibák nélkül futtathatják a folyamatot. Lásd Mi a függőleges automatikus skálázás?
Meglévő folyamat átalakítása kiszolgáló nélkülire
A Unity Katalógusban konfigurált meglévő folyamatokat kiszolgáló nélküli folyamatokká alakíthatja. Hajtsa végre a következő lépéseket:
- A Azure Databricks munkaterület oldalsávján kattintson a Feladatok és Folyamatok.
- Kattintson a folyamat nevére .
- Kattintson a Beállítások gombra.
- A jobb oldali oldalsáv Számítás területén kattintson a
- Jelölje be a kiszolgáló nélkülimelletti jelölőnégyzetet.
- Kattintson a Mentés lehetőségre.
Fontos
A kiszolgáló nélküli engedélyezéskor a folyamathoz konfigurált számítási beállítások törlődnek. Ha egy folyamatot visszakapcsol nem kiszolgáló nélküli frissítésekre, újra kell konfigurálnia a kívánt számítási beállításokat a folyamatkonfigurációra.
Kiszolgáló nélküli folyamat DBU-használatának megkeresése
A kiszolgáló nélküli Lakeflow-folyamatok DBU-használatát a számlázható használati tábla lekérdezésével találja meg, amely a Azure Databricks rendszertáblák része. Lásd : Mi a kiszolgáló nélküli folyamatok DBU-felhasználása?.