OneLake nedir?

Microsoft OneLake tüm kuruluşunuz için birleşik bir veri gölüdür. Her Microsoft Fabric kiracısı otomatik olarak OneLake'i içerir ve tüm analiz verileriniz için tek yerdir. Kuruluş genelinde analiz ve yapay zeka iş yükleri için tüm verilerinizi depolayabileceğiniz, yönetebileceğiniz ve yönetebileceğiniz merkezi bir depo.

OneLake, Azure Data Lake Storage üzerine kurulmuştur ve tabloları Delta Parquet veya Iceberg biçiminde depolar, herhangi bir aracın okuyabileceği iki açık standart. Bu yaklaşım, verilerinizin özel biçimlere kilitlenmemesi anlamına gelir.

OneLake şu bilgileri sağlar:

  • Yerleşik idare ve güvenlik ile kuruluşun tamamı için birleşik veri depolama
  • Çoğaltma olmadan birden çok analitik altyapıyla kullanmak için tek bir veri kopyası
  • Dosya gezgini, ADLS 2. Nesil API'leri ve Azure hizmet tümleştirmeleri aracılığıyla esnek bağlantı
  • Yerleşik yedeklilik, olağanüstü durum kurtarma ve erişim tanılaması ile veri koruma ve izleme

Birleşik veri depolama

OneLake'den önce, kuruluşlar genellikle farklı iş grupları için birden çok göl oluşturmuş ve bu da birden çok kaynağı yönetmek için ek yük oluşturmuştur. Bu silolu yaklaşım ekipler arasında işbirliği yapılmasını zorlaştırdı, veri projelerini yavaşlattı ve yineleme riskini artırdı.

OneLake, size tüm kuruluş için merkezi bir veri erişim noktası vererek bu zorlukları çözer. Her Fabric kiracısı tek bir OneLake örneğine sahiptir. OneLake'i silemez veya birden çok OneLakes oluşturamazsınız ve sağlanıp yönetilecek altyapı yoktur. Bölümler, ekipler ve projeler verilerini bu birleşik veri gölünde depolayabilir veya verilerine burada bağlanabilir ve bunları, her birinin kendi yöneticisi olan Fabric etki alanları, alt etki alanları ve çalışma alanlarını kullanarak düzenleyebilir. Bu model veri sahipliğini korur ve federasyon idaresini etkinleştirirken, yetkili kullanıcıların çakışma olmadan verileri bulmasına ve kullanmasına izin verir.

Dağıtılmış sahiplikle merkezi olarak yönetilir

Fabric veriler, kuruluş ve idare için aşağıdaki hiyerarşide bulunur:

  • Kiracı: Kiracı düzeyinde ilkeler güvenlik, uyumluluk ve veri yönetimi için OneLake'e gelen tüm verileri otomatik olarak korur.
  • Çalışma alanı: Verilerinizi düzenlemek için kiracınızda istediğiniz sayıda çalışma alanı oluşturabilirsiniz. Çalışma alanları, kuruluşun farklı bölümlerinin sahiplik ve erişim ilkelerini dağıtmasını sağlar. Her çalışma alanı, belirli bir bölgeye bağlı olan ve ayrı olarak faturalandırılan bir kapasitenin parçasıdır.
  • Veri öğeleri: Çalışma alanları göl evleri, ambarlar, eventhouse'lar ve KQL veritabanları gibi veri öğelerini içerir. Her öğe türü Spark tabanlı analiz, T-SQL sorguları, gerçek zamanlı akış ve daha fazlası gibi belirli iş yükleri için özel olarak oluşturulur.

OneLake'in işlevini ve yapısını gösteren diyagram.

Daha fazla bilgi için bkz . Çalışma alanları.

OneLake kataloğunu keşfet ve yönet

OneLake kataloğu, veri uzmanlarının ve iş kullanıcılarının sahip oldukları ve OneLake genelinde erişebilecekleri verileri keşfetmesi, yönetmesi ve yönetmesi için tek bir yerdir.

Kullanıcılar etki alanına, çalışma alanına, öğe türüne, onaylara ve daha fazlasına göre filtreleyerek tam olarak ihtiyaç duydukları şeyi bulabilir ve her veri öğesi açıklamalar, sahipler, şema, köken ve kullanım ölçümleri gibi meta verilerle zenginleştirilir.

Veri sahipleri duyarlılık etiketi kapsamı, etiketleme, onaylar ve veri konumuyla ilgili görünürlük de dahil olmak üzere veri kalitesini ve uyumluluğu geliştirmek için içgörüler ve önerilen eylemler alabilir.

Daha fazla bilgi için bkz. OneLake kataloğu.

Security

OneLake'in güvenlik modeli, hassas bilgileri açığa çıkarmadan verileri geniş bir şekilde paylaşmanızı sağlar. OneLake güvenlik rollerini kullanarak veri öğeleri üzerinde belirli klasörlere, tablolara, hatta satırlara ve sütunlara kadar ayrıntılı izinler tanımlayabilirsiniz. Örneğin, bir satış veri kümesini bir ekiple paylaşabilir ancak sütuna erişimi kısıtlayabilir veya iş ortağının Cost yalnızca bulunduğu Region = "US"satırları görmesine izin vekleyebilirsiniz. OneLake bu rolleri depolar ve bunları tüm analiz deneyimlerinde otomatik olarak uygular. Bu nedenle, bir kullanıcının veri kümesinin yalnızca bir bölümüne erişimi varsa, bu kural SQL aracılığıyla sorgulama, Spark not defteri çalıştırma veya Power BI raporu görüntüleme gibi işlemler için geçerlidir. OneLake yalnızca görmelerine izin verilenleri görmelerini sağlar.

Bu birleşik güvenlik yaklaşımı, kullanıcıların farklı altyapılarda ayrı izinler tutmak zorunda olmadığı anlamına gelir. Ayrıca, veriler başka birinin sahip olduğu bir göl evi veya çalışma alanına geçirilse bile özgün veri sahiplerinin veri kaynağına kimlerin erişebileceği üzerinde her zaman denetim sahibi olduğu anlamına gelir.

OneLake öğelerine duyarlılık etiketlerini bir belgeye uyguladığınız gibi uygulayabilirsiniz ve veriler Excel veya başka bir aralığa aktarılmış olsa bile bu etiketler şifreleme veya erişim kısıtlamalarını zorunlu kılabilir. Benzer şekilde, veri kaybı önleme (DLP) ilkeleri OneLake'ten hassas veri yüklemelerini veya indirmelerini algılayabilir ve olası veri sızıntılarını önleyebilir veya uyarı verebilir.

Daha fazla bilgi için bkz. OneLake'te verilerinizin güvenliğini sağlamaya başlama.

Verilerin bir kopyası

Tüm Fabric analiz altyapıları verilerle doğrudan OneLake'te çalışır. Verileri başka bir altyapıyla kullanmak veya birden çok kaynaktan gelen verileri analiz etmek için kopyalamanız gerekmez.

Kısayollar

Kısayol, diğer dosya konumlarında depolanan verilere başvurudur. Bu dosya konumları aynı çalışma alanında, OneLake'de farklı bir çalışma alanında veya OneLake'in dışında olabilir. OneLake, Azure Data Lake Storage, Azure Blob depolama, Amazon S3 ve S3 uyumlu kaynaklar, Iceberg uyumlu kaynaklar, Microsoft Dataverse, şirket içi kaynaklar ve daha fazlası için kısayolları kullanabilirsiniz. Konum ne olursa olsun, kısayollar dosya ve klasörleri yerel olarak depolamış gibi gösterir.

Kısayollar, kuruluşunuzun verileri kopyalamadan bulutlar ve etki alanları arasında birleştirmesine olanak sağlar. Teams ayrı çalışma alanlarında bağımsız olarak çalışabilir ve verileri yinelemek yerine birbirleriyle paylaşmak için kısayolları kullanabilir. Örneğin, bir ekip başka bir ekibin çalışma alanındaki bir veri kümesine veya bir dış S3 demetine kısayol oluşturabilir ve ardından bu verileri OneLake'te kendi veri kümeleriyle birleştirebilir. Kısayol kaynağı işaret ettiğinden, kaynak veriler güncelleştirildiğinde bu değişiklikler OneLake üzerinden hemen görünür. Bu şekilde, verileri taşımadan veya yinelemeden, belirli bir gereksinime uyacak şekilde birden çok iş grubundan verileri bir araya getiren sanal ürünler veya görünümler oluşturabilirsiniz. Kısayol dönüşümlerini kullanarak, veri biçimini dönüştürme veya kişisel bilgileri (PII) kaldırma gibi verilere otomatik değişiklikler de uygulayabilirsiniz.

Kısayolların çalışma alanları ve öğeler arasında verileri nasıl bağlayacağını gösteren diyagram.

Kısayolları kullanma hakkında daha fazla bilgi için bkz . OneLake kısayolları.

Yansıtma

Fabric'te yansıtma, çeşitli sistemlerden gelen verileri sürekli olarak OneLake'e çoğaltan, düşük maliyetli ve düşük gecikmeli bir çözümdür. Bir dış veri kaynağına güvenli bir şekilde bağlanabilir ve seçili veritabanlarını veya tabloları OneLake'in açık biçimine otomatik olarak yansıtabilir (kopyalayabilir) ve neredeyse gerçek zamanlı olarak eşitlenmiş durumda tutabilirsiniz. Yansıtılan veriler OneLake'te Delta Parquet olarak depolanır, bu nedenle herhangi bir Fabric altyapısı tarafından analize hemen hazır olur.

Yansıtma, Azure SQL Veritabanı, Azure Cosmos DB, PostgreSQL için Azure Veri Tabanı, Azure Databricks (Unity Kataloğu), Snowflake ve daha fazlası gibi kaynakları destekler. Kaynaktaki değişiklikler sürekli olarak yansıtılır, böylece OneLake kopyanız manuel ETL işleri olmadan güncel kalır. Doğrudan üretim kaynağını sorgulamadan yeni veriler üzerinde analiz, yapay zeka veya Power BI raporları çalıştırabilirsiniz.

Daha fazla bilgi için bkz. Fabric'da yansıtma nedir?

Birden çok analiz motorunda işbirliği yapma

Fabric analiz altyapıları (T-SQL, Apache Spark, Analysis Services ve diğerleri) verileri OneLake'te açık Delta Parquet biçiminde depolar. Bu standartlaştırma, aynı verileri birden çok altyapıda kullanmanıza olanak tanır. Verileri yalnızca başka bir altyapıyla kullanmak için kopyalamanız gerekmez veya verilerinizin bulunduğu yer bu olduğundan belirli bir altyapıyı kullanırken takılı kalmış gibi hissetmeniz gerekmez.

Örneğin, SQL mühendislerinden oluşan bir ekip tam işlemli bir veri ambarı oluşturur. Tablo oluşturmak, verileri dönüştürmek ve verileri tablolara yüklemek için T-SQL altyapısını kullanır. Bir veri bilimcisi bu verileri kullanmak istiyorsa, OneLake'e bir Spark not defteri ekleyebilir ve bu tabloları doğrudan okuyabilir. OneLake tabloları Delta biçiminde depoladığı için Spark, özel bağlayıcılar veya veri dışarı aktarma işlemleri olmadan bunları yükleyebilir. Hem SQL sorguları hem de Spark işleri OneLake'deki verilerin bir kopyası üzerinde çalışır.

Ayrıca, iş kullanıcıları Analysis Services altyapısındaki Direct Lake modunu kullanarak OneLake üzerinde Power BI raporlar oluşturabilir. Direct Lake modu, büyük hacimli verileri kopyalamadan hızla yükleyen ve yenileyen bir veri erişim modudur. Daha fazla bilgi için bkz. Direct Lake'e genel bakış.

Spark kullanarak veri yüklemeyi, T-SQL kullanarak sorgulamayı ve verileri Power BI raporunda görüntülemeyi gösteren örnek diyagram.

Açık tablo biçimi birlikte çalışabilirliği

OneLake , meta veri sanallaştırma aracılığıyla hem Delta Lake hem de Apache Iceberg tablo biçimlerini destekler. Bu özellik, Iceberg tablolarının Fabric iş yükleri arasında Delta Lake tabloları olarak okunabilmesi ve Delta Lake tablolarının dış Iceberg okuyucuları tarafından okunabilmesi için otomatik olarak sanal meta veriler oluşturur. Iceberg tablolarını doğrudan OneLake'e yazabilir veya harici olarak depolanan Iceberg tablolarına kısayollar oluşturabilirsiniz ve OneLake bunları el ile dönüştürme olmadan tüm Fabric altyapılar için kullanılabilir hale getirir. Benzer şekilde, OneLake'teki herhangi bir Delta Lake tablosuna Snowflake gibi Iceberg uyumlu hizmetler tarafından erişilebilir.

Daha fazla bilgi için bkz. OneLake ile Iceberg tablolarını kullanma.

OneLake'e bağlanma

OneLake verilerine Fabric portalından, Windows, mevcut Azure araçlarından veya ADLS 2. Nesil API'lerini destekleyen herhangi bir uygulamadan erişebilirsiniz.

Windows için OneLake dosya gezgini

Windows için OneLake dosya gezginini kullanarak OneLake verilerini Windows inceleyebilirsiniz. Tüm çalışma alanlarınızda ve veri öğelerinizde gezinebilir, dosyaları Office'te yaptığınız gibi kolayca karşıya yükleyebilir, indirebilir veya değiştirebilirsiniz. OneLake dosya gezgini, veri gölleriyle çalışmayı basitleştirerek teknik olmayan işletme kullanıcılarının bile bunları kullanabilmesini sağlar.

Daha fazla bilgi için bkz . OneLake dosya gezgini.

ADLS 2. Nesil API'leri ve SDK'ları

OneLake, mevcut ADLS 2. Nesil uygulamalarını kullanabilmeniz için Azure Data Lake Storage (ADLS) 2. Nesil API'lerini ve SDK'larını destekler. Her çalışma alanı kapsayıcı olarak görünür ve veri öğeleri bu kapsayıcıların içinde klasör olarak görünür. Daha fazla bilgi için bkz. OneLake erişimi ve API'leri.

API'ler ve SDK'lar ile OneLake verilerine nasıl erişebileceğinizi gösteren diyagram.

OneLake ADLS 2. Nesil uygulamalarıyla uyumlu olduğundan, Azure hizmetlerden OneLake'e bağlanabilirsiniz. Örneğin:

Veri koruma ve izleme

OneLake, verilerinizi güvende tutmak ve nasıl kullanıldıklarına yönelik görünürlük sağlamak için yerleşik özellikler içerir.

Olağanüstü durum kurtarma ve veri koruma

OneLake, yerleşik yedeklilik ile verilerinizi otomatik olarak korur. Kullanılabilirlik alanlarını destekleyen bölgelerde OneLake, verileri birden çok veri merkezi arasında çoğaltmak için alanlar arası yedekli depolama (ZRS) kullanır. Diğer bölgelerde yerel olarak yedekli depolama (LRS) kullanır. Bölge genelindeki kesintilere karşı ek koruma için, verilerinizi eşleştirilmiş bir Azure bölgeye coğrafi olarak çoğaltmak için kapasitede iş sürekliliğini ve olağanüstü durum kurtarmayı (BCDR) etkinleştirebilirsiniz. OneLake ayrıca geçici silmeyi de destekler ve bu da silinen dosyaları yedi gün boyunca saklar, böylece yanlışlıkla silme işlemlerinden kurtarabilirsiniz.

Daha fazla bilgi için bkz . OneLake için olağanüstü durum kurtarma ve veri koruması.

Tanılama

OneLake tanılaması, Fabric ortamınızda verilere nasıl erişilip kullanıldıklarına yönelik görünürlük sağlar. Çalışma alanı düzeyinde tanılamayı etkinleştirdiğinizde, veri erişimi olaylarını günlükler olarak bir lakehouse’a akıtır. Kimlerin hangi verilere, ne zaman ve nasıl eriştiği izleyebilirsiniz. Bu günlük Fabric kullanıcı arabirimindeki kullanıcı eylemlerini, API'ler ve analiz altyapıları aracılığıyla programlı erişimi ve kısayollar aracılığıyla çalışma alanları arası erişimi kapsar.

Daha fazla bilgi için bakın OneLake tanı araçları.