はじめに
SQL Server 2025 のデータ仮想化は、データが存在する場所のデータにアクセスする機能です。 データ仮想化は、元のデータをレプリケートまたは移動することなく、クエリ時にデータを統合します。
このトレーニング モジュールでは、次のような SQL Server 2025 のデータ仮想化オプションを確認します。
- PolyBase サービス
- データ仮想化による新しいアクセスを可能にする Azure Data Lake Storage、Azure Blob Storage、Amazon S3 互換オブジェクト ストレージなどの REST API コネクタ
- OPENROWSET、CREATE EXTERNAL TABLE (CET)、CREATE EXTERNAL TABLE AS SELECT (CETAS) など、データ仮想化に使用される Transact-SQL (T-SQL)
データ仮想化の原則
データ仮想化は、次の 3 つの原則に依存します。
データの抽象化: データの抽象化により、基になるデータ システム、形式、および構造からデータ アクセスの複雑さが隠されます。
ゼロ レプリケーション: 従来の抽出-変換-読み込み (ETL) とは異なり、データ仮想化ではデータを別のリポジトリに収集して変換先の形式に変換する必要はありませんが、変換と集計は即座に処理されます。
リアルタイム データ: データ仮想化は、その場でデータ ソースに接続するため、常に利用可能な最新のデータを使用します。
データ仮想化の利点
データ仮想化には、次の主な利点があります。
データ移動なし: 現在の場所のデータにアクセスします。
T-SQL 言語: T-SQL 言語のすべての利点、そのコマンド、拡張機能、および知識を使用します。
すべてのデータに対して 1 つのソース: SQL Server 2025 を単一のデータ ソースとして使用し、必要なすべてのデータにデータ ハブを使用し、アプリケーションからデータの複雑さを隠します。 データベース管理者とデータ エンジニアは、1 つの環境を維持できます。
セキュリティ: SQL Server のセキュリティ機能を使用して、詳細なアクセス許可、資格情報の管理、制御を行います。
コストの柔軟性: すべての SQL Server 2025 エディションで使用できます。
データ仮想化のユース ケース
SQL Server 2025 には、次の主要なデータ仮想化のユース ケースが用意されています。
- データベース内分析: データ仮想化を使用する場合は、すべての SQL Server の機能と知識を使用して結合します。
- 他のデータ ソースにデータをオフロードまたはエクスポートします。
- データ ハブ: SQL Server を一元化されたハブとして使用して、さまざまなデータ ソースとファイルに接続、保護、クエリを実行し、アプリケーションの複雑さを隠します。 ETL ツールを使用して、データを集計、コピー、またはステージング領域に移動する必要はありません。
学習の目的
このモジュールを完了すると、次の操作が行われます。
- データ仮想化の利点と原則を理解します。
- PolyBase とは何か、その機能を使用する方法について説明します。
- オブジェクト ストレージ ソリューションと、S3 と互換性のあるオブジェクト ストレージに対する SQL Server 2025 のサポートについて理解している。
- SQL Server 2025 に PolyBase をインストールして構成する方法について説明します。
- SQL Server 2025 で PolyBase を使用して外部データにアクセスしてクエリを実行する方法について説明します。
前提条件
- SQL Server 2025 の基本的な作業知識
- T-SQL と SQL クエリの実行に関する基本的な知識
- SQL Server 2025 がインストールされている
- SQL Server Management Studio (SSMS) がインストールされている