Panoramica dei dati

Questo articolo offre una panoramica dei metodi disponibili per assorbire dati in un Eventhouse utilizzando l'esperienza Get data.

Screenshot dei tipi di dati disponibili nell'esperienza get data in Eventhouses in Real-Time Intelligence.

Origini dati

Puoi assorbire dati in un Eventhouse dalle seguenti fonti:

Origini dati aggiuntive

Se la tua sorgente non è elencata, seleziona Collega più fonti di dati per usare i connettori disponibili tramite Real-Time hub. Puoi portare i dati in Eventstream e poi in Eventhouse senza uscire dal flusso di lavoro Get Data. Per questi casi, seleziona l'opzione Collega più fonti dati .

Supporto per messaggi di grandi dimensioni (anteprima)

Importante

Questa funzionalità si trova in Anteprima.

Quando ottieni dati da un Eventstream o da un file locale, l'anteprima dei dati include una casella di spunta Consenti valori grandi per string colonne e dynamic . Quando attivato, permette alle singole celle di contenere valori da 1 MB fino a 32 MB. Questa capacità ti permette di mantenere insieme un grande carico utile in una singola cella quando lo scenario lo richiede.

Ad esempio, memorizzare ed elaborare un documento JSON di grandi dimensioni in una singola colonna eventhouse string o dynamic. Se il tuo scenario beneficia invece di un modello dati più strutturato, puoi trasformare il payload in colonne separate utilizzando l'Event Processing Editor di Eventstream prima dell'ingestione, oppure una policy di aggiornamento di Eventhouse dopo l'ingestione.

Per scenari di analisi, suddividere i messaggi grandi in colonne più piccole e strutturate è generalmente più efficiente. Questo approccio può ridurre il consumo di memoria e le operazioni di I/O (input/output) quando memorizzi, indicizzi e interroghi i dati.

Importante

Come parte della procedura guidata di ingestione, un meccanismo di inferenza dello schema analizza i primi 1.000 record dei dati di anteprima in ingresso. Se identifica un valore grande tra quei record, seleziona automaticamente la casella di spunta e mostra un messaggio che ti notifica che sono stati rilevati valori grandi. Se un valore grande appare più avanti nei dati, il motore di inferenza di schema non lo rileva automaticamente e devi selezionare manualmente la casella per ingerire valori superiori a 1 MB per cella. I formati AVRO, Parquet e TXT non vengono scansionati per i messaggi grandi durante questa configurazione guida. Per questi formati, devi selezionare Consenti valori grandi se ti aspetti string o dynamic valori superino 1 MB per cella. Il supporto per i messaggi di grandi dimensioni non è disponibile per i collegamenti (tabelle esterne) e per le tabelle con accelerazione delle query tramite collegamenti OneLake. La disponibilità dei dati OneLake per le tabelle con colonne di valore grande dipende dai limiti di dimensione target.

Puoi anche attivare questa opzione per una colonna di tabella esistente in seguito. Per maggiori informazioni, vedi Consenti valori grandi per una colonna. Questa modifica si applica solo ai nuovi dati ingeriti in futuro; i valori precedentemente string ingeriti vengono troncati al limite (MaxValueSize la proprietà della policy predefinita è 1 MB), dynamic i valori vengono sostituiti da nulli.

Quando abilitata, la colonna utilizza la BigObjectIndexed32 politica di codifica, che indicizza valori elevati per le prestazioni delle query ma aumenta il consumo di memoria. Per verificare se la policy è abilitata per una colonna, vedi Politica di codifica, oppure visualizzala nel pannello laterale dettagli della tabella in Manage e monitora una tabella del database KQL. Per maggiori informazioni sulla politica, vedi Tipi di policy di codifica.