Catatan
Akses ke halaman ini memerlukan otorisasi. Anda dapat mencoba masuk atau mengubah direktori.
Akses ke halaman ini memerlukan otorisasi. Anda dapat mencoba mengubah direktori.
Penyerapan data adalah proses pemuatan data dari satu atau beberapa sumber ke dalam tabel dalam Azure Data Explorer. Setelah penyerapan, data tersedia untuk kueri. Dalam artikel ini, Anda mempelajari cara mendapatkan data dari Amazon S3 ke dalam tabel baru atau yang sudah ada.
Untuk informasi selengkapnya tentang Amazon S3, lihat Apa itu Amazon S3?
Untuk informasi umum tentang penyerapan data, lihat gambaran umum penyerapan data Azure Data Explorer.
Prasyarat
- Identitas pengguna akun Microsoft atau Microsoft Entra. Anda tidak memerlukan langganan Azure.
- Masuk ke UI web Azure Data Explorer.
- Sebuah kluster dan database Azure Data Explorer. Membuat kluster dan database.
Dapatkan data
Pilih Kueri dari menu sebelah kiri.
Klik kanan database tempat Anda ingin menyerap data, lalu pilih Dapatkan data.
Sumber
Di jendela Dapatkan data, tab Sumber dipilih.
Pilih sumber data dari daftar yang tersedia. Dalam contoh ini, serap data dari Amazon S3.
Konfigurasikan
Pilih database dan tabel tujuan. Untuk menyerap data ke dalam tabel baru, pilih + Tabel baru dan masukkan nama tabel.
Catatan
Nama tabel dapat mencapai 1.024 karakter, termasuk spasi, karakter alfanumerik, tanda hubung, dan garis bawah. Karakter khusus tidak didukung.
Di bidang URI, tempelkan string koneksi untuk satu wadah atau objek individual dalam format berikut.
Wadah:
https://Nama Bucket.s3.Nama Wilayah.amazonaws.comObjek: ObjectName
;AwsCredentials=AwsAccessID,AwsSecretKeySecara opsional, Anda dapat menerapkan filter wadah untuk memfilter data sesuai dengan ekstensi file tertentu.
Catatan
Penyerapan mendukung ukuran file maksimum 6 GB. Rekomendasinya adalah menyerap file antara 100 MB dan 1 GB.
Pilih Selanjutnya.
Inspeksi
Tab periksa terbuka dengan pratinjau data.
Untuk menyelesaikan proses penyerapan, pilih Selesai.
Opsional:
- Pilih Penampil perintah untuk melihat dan menyalin perintah otomatis yang dihasilkan dari input Anda.
- Gunakan menu dropdown File definisi skema untuk mengubah file yang digunakan untuk menyimpulkan skema.
- Ubah format data yang disimpulkan secara otomatis dengan memilih format yang diinginkan dari menu dropdown. Lihat format Data yang didukung oleh Azure Data Explorer untuk penyerapan.
- Edit kolom.
- Jelajahi Opsi tingkat lanjut berdasarkan jenis data.
Edit kolom
Catatan
- Untuk format tabular (CSV, TSV, PSV), Anda tidak dapat memetakan kolom dua kali. Untuk memetakan ke kolom yang sudah ada, pertama-tama hapus kolom baru.
- Anda tidak dapat mengubah tipe kolom yang sudah ada. Jika Anda mencoba memetakan ke kolom yang memiliki format yang berbeda, Anda mungkin berakhir dengan kolom kosong.
Perubahan yang dapat Anda lakukan dalam tabel tergantung pada parameter berikut:
- Jenis tabel baru atau sudah ada
- Jenis pemetaan baru atau sudah ada
| Jenis tabel | Jenis Pemetaan | Penyesuaian yang tersedia |
|---|---|---|
| Tabel Baru | Pemetaan Baru | Ganti nama kolom, ubah jenis data, ubah sumber data, transformasi pemetaan, tambahkan kolom, hapus kolom |
| Tabel yang sudah ada | Pemetaan Baru | Tambahkan kolom (di mana Anda kemudian dapat mengubah jenis data, mengganti nama, dan memperbarui) |
| Tabel yang sudah ada | Pemetaan yang ada | tidak ada |
Pemetaan transformasi
Beberapa pemetaan format data (Parquet, JSON, dan Avro) mendukung transformasi sederhana pada waktu penerimaan data. Untuk menerapkan transformasi pemetaan, buat atau perbarui kolom di jendela Edit kolom .
Transformasi pemetaan dapat dilakukan pada kolom jenis string atau datetime, dengan sumber memiliki tipe data int atau long. Transformasi pemetaan yang didukung adalah:
- TanggalWaktuDariDetikUnix
- DateTimeFromUnixMilliseconds
- DateTimeFromUnixMicroseconds
- DateTimeFromUnixNanoseconds
Opsi tingkat lanjut berdasarkan jenis data
Data Tabular (CSV, TSV, PSV):
Jika Anda menyerap format tabular dalam tabel yang sudah ada, Anda dapat memilih menu drop-down pemetaan tabel dan pilih Gunakan pemetaan yang sudah ada. Data tabular tidak selalu menyertakan nama kolom yang digunakan untuk memetakan data sumber ke kolom yang ada. Ketika opsi ini dicentang, pemetaan dilakukan secara berurutan, dan skema tabel tetap sama.
Jika tidak, buat pemetaan baru.
Untuk menggunakan baris pertama sebagai nama kolom, pilih Header baris pertama.
JSON:
- Untuk menentukan pembagian kolom data JSON, pilih Tingkat berlapis, dari 1 hingga 100.
Ringkasan
Di jendela Persiapan data, ketiga langkah menunjukkan tanda centang hijau saat penyerapan data berhasil diselesaikan. Anda bisa menampilkan perintah yang digunakan setiap langkah, atau memilih kartu untuk mengkueri, memvisualisasikan, atau menghilangkan data yang diserap.