Nastavení konfigurace výpočetních prostředků Sparku v prostředích Fabric

Prostředí Microsoft Fabric pro datové inženýrství a datové vědy fungují na plně spravované výpočetní platformě Sparku. Ve výchozím nastavení všechny úlohy Sparku v pracovním prostoru sdílejí stejné nastavení fondu a prostředků, ale různé úlohy mají často různé požadavky. Jednoduchá transformace dat nepotřebuje stejnou paměť ovladače jako úloha strojového učení ve velkém měřítku.

Prostředí platformy umožňují přizpůsobit konfiguraci výpočtů Spark pro každou úlohu, takže každý poznámkový blok nebo definice úlohy Sparku mohou běžet se správnou verzí modulu runtime, fondem a velikostí ovladače a exekutoru, aniž by se měnily výchozí předvolby pracovního prostoru.

Konfigurace nastavení výpočetních prostředků na úrovni pracovního prostoru

Správci pracovního prostoru určují, jestli položky prostředí můžou přepsat výchozí konfiguraci výpočetních prostředků pracovního prostoru. Zachování zakázaného přizpůsobení na úrovni položek zajišťuje konzistentní využití prostředků v celém pracovním prostoru. Když ho povolíte, získáte členům a přispěvatelům flexibilitu při ladění výpočetních prostředků pro jednotlivé úlohy.

  1. V prohlížeči přejděte do vašeho pracovního prostoru Fabric na portálu Fabric.

  2. Vyberte nastavení pracovního prostoru.

  3. Vyberte Datové inženýrství nebo vědu a pak vyberte Nastavení Sparku.

  4. Vyberte kartu Fond .

  5. Přepněte přizpůsobení konfigurací výpočetních prostředků pro položky do polohy Zapnuto.

    Snímek obrazovky znázorňující možnost přizpůsobení výpočetních prostředků na úrovni položek v nastavení pracovního prostoru

    Když je tento přepínač zapnutý, členové a přispěvatelé můžou měnit výpočtové konfigurace na úrovni relace v prostředí Fabric. Když je vypnutá, oddíl Výpočty v položkách prostředí je zakázaný a všechny úlohy Sparku používají výchozí fond pracovního prostoru.

  6. Vyberte Uložit.

Konfigurace výpočetních prostředků v prostředí

Jakmile správce pracovního prostoru povolí přizpůsobení na úrovni položek, můžete nakonfigurovat výpočetní nastavení uvnitř položky prostředí. To zahrnuje výběr modulu runtime Spark, výběr fondu a ladění prostředků ovladače a exekutoru.

Vyberte modul runtime Spark

  1. Otevřete položku prostředí.

  2. Na kartě Domů vyberte rozevírací seznam Runtime a zvolte verzi modulu runtime.

    Snímek obrazovky znázorňující, jak vybrat verzi modulu runtime pro prostředí

Každý modul runtime Spark má vlastní výchozí nastavení a předinstalované balíčky.

Důležité

  • Změny modulu runtime se neprojeví, dokud prostředí neuložíte a nepublikujete.
  • Pokud existující knihovny nebo nastavení výpočetních prostředků nejsou kompatibilní s vybraným modulem runtime, publikování selže. Odeberte nebo aktualizujte nekompatibilní nastavení a pak znovu publikujte.
  • Podrobné pokyny k publikování najdete v tématu Uložení a publikování změn.

Vyberte fond a vylaďte vlastnosti výpočetních prostředků.

  1. Otevřete prostředí a přejděte do části Výpočty .

  2. V části Fond prostředí vyberte počáteční fond nebo vlastní fond vytvořený správcem pracovního prostoru.

    Snímek obrazovky znázorňující, kde vybrat fondy v části Výpočty prostředí

  3. Pomocí rozevíracích seznamů na stránce Compute nakonfigurujte vlastnosti Sparku na úrovni relace pro vybraný fond. Dostupné hodnoty závisí na velikosti uzlu fondu.

    Snímek obrazovky s rozevíracími seznamy výpočetních vlastností v části Výpočetní prostředí

    Mezi vlastnosti patří:

    • Jádra ovladačů Spark – počet jader přidělených ovladači Sparku
    • Paměť ovladače Spark – množství paměti přidělené ovladači Spark.
    • Jádra exekutoru Sparku – počet jader přidělených jednotlivým exekutorům
    • Paměť exekutoru Sparku – množství paměti přidělené každému exekutoru

Podrobnosti o dostupných velikostech fondů a limitech prostředků najdete ve Spark compute v Platformě Fabric.

Poznámka:

Vlastnosti Sparku nastavené prostřednictvím řízení na úrovni aplikace pomocí spark.conf.set nesouvisejí s nastaveními výpočetního výkonu prostředí popsanými zde.