ตัวเลือกข้อมูลที่จัดลําดับขั้นสําหรับกระแสข้อมูล Gen2

Note

ตัวเลือกข้อมูลที่จัดเป็นระยะที่อธิบายไว้ในบทความนี้อยู่ในการแสดงตัวอย่าง

เมื่อคุณเปิดใช้งาน staging ในคิวรี กระแสข้อมูล Gen2 จะเขียนผลลัพธ์ระดับกลางไปยัง Lakehouse การจัดเตรียมภายใน เพื่อให้กลไกจัดการสามารถใช้การคํานวณ Fabric สําหรับการแปลงหรือส่งข้อมูลไปยังปลายทางได้

ส่วน ข้อมูลแบบเป็นลําดับขั้น ในการตั้งค่ามาตราส่วนกระแสข้อมูลช่วยให้คุณสามารถปรับแต่งสองแง่มุมของไปป์ไลน์นั้นได้:

  • คัดลอกที่ปรับให้เหมาะสมไปยัง Lakehouse (พรีวิว) — ใช้เส้นทางที่เร็วขึ้นเพื่อเขียนข้อมูลที่จัดเตรียมไปยังปลายทางข้อมูล Fabric Lakehouse
  • เปิดใช้งานการบีบอัด V-Order (พรีวิว) — ใช้การบีบอัด V-Order กับข้อมูลที่เขียนไปยังเลคเฮาส์ที่จัดเตรียมไว้

ทั้งสองตัวเลือกมีผลที่ระดับกระแสข้อมูลและมีผลเฉพาะในกระแสข้อมูล Gen2 เท่านั้น

จะหาการตั้งค่าได้ที่ไหน

  1. เปิดกระแสข้อมูลของคุณในตัวแก้ไข Power Query
  2. เลือก ตัวเลือก จากเมนู
  3. ไปที่แท็บมาตราส่วน
  4. การตั้งค่าทั้งสองจะแสดงอยู่ภายใต้ ข้อมูลที่จัดลําดับ

สกรีนช็อตของกล่องโต้ตอบตัวเลือกที่มีแท็บมาตราส่วนถูกเลือกและส่วนข้อมูลที่แบ่งเป็นลําดับขั้นถูกเน้น

คัดลอกที่ปรับให้เหมาะสมไปยัง Lakehouse (พรีวิว)

เมื่อเปิดตัวเลือกนี้ กระแสข้อมูล Gen2 จะใช้เส้นทางการเคลื่อนย้ายข้อมูลที่ปรับให้เหมาะสมสําหรับคิวรีที่:

  • เปิดใช้งาน การแสดงละคร และ
  • เขียนไปยังปลายทางข้อมูล Fabric Lakehouse

ในเส้นทางเริ่มต้น ข้อมูลจะไหลจากคลังสินค้าการจัดเตรียมไปยังเลคเฮาส์ด้วยการทําให้เป็นอนุกรมและการกระโดดเครือข่ายเพิ่มเติม เส้นทางที่ปรับให้เหมาะสมช่วยลดการกระโดดเหล่านั้น ซึ่งสามารถลดเวลาการรีเฟรชได้อย่างมากสําหรับกระแสข้อมูลที่หนักหน่วงซึ่งลงจอดใน Lakehouse

สําหรับตัวอย่างที่วัดได้เกี่ยวกับผลกระทบของเวลารีเฟรชและการใช้ CU ของตัวเลือกนี้ ดูที่ สถานการณ์ที่ 3: การคัดลอกที่ปรับแต่งไปยัง Lakehouse ในมาตรฐานต้นทุนและประสิทธิภาพ Dataflow Gen2

เวลาที่ใช้

เปิดสิ่งนี้เมื่อคุณจัดเตรียมคิวรีที่ในที่สุดก็เข้าสู่ปลายทางข้อมูล Fabric Lakehouse การแสดงละครจะมีประโยชน์มากที่สุดเมื่อ:

  • คิวรีของคุณมีการแปลงที่ไม่พับไปยังแหล่งที่มา
  • คุณต้องการพึ่งพาการคํานวณการจัดเตรียม Fabric (Lakehouse หรือ Warehouse) เพื่อเรียกใช้การดําเนินการที่หนักหน่วง เช่น การรวม การจัดกลุ่มตาม หรือตัวกรองก่อนที่จะเขียนไปยังปลายทาง

สําหรับข้อมูลเพิ่มเติมเกี่ยวกับวิธีใช้การจัดเตรียม โปรดดู แนวทางปฏิบัติที่ดีที่สุดเพื่อให้ได้ประสิทธิภาพที่ดีที่สุดด้วย Dataflow Gen2

การทำงานตามค่าเริ่มต้น

ตัวเลือกจะปิดอยู่ตามค่าเริ่มต้น สําหรับกระแสข้อมูลส่วนใหญ่ที่จัดเตรียมข้อมูลและเขียนไปยัง Fabric Lakehouse การเปิดตัวเลือกนี้จะเป็นประโยชน์

ข้อควรพิจารณา

  • ตัวเลือกนี้จะมีผลเฉพาะกับคิวรีที่เปิดใช้งานการจัดเตรียมและเขียนไปยังปลายทางข้อมูล Fabric Lakehouse เท่านั้น สําหรับคิวรีที่เขียนไปยังปลายทางอื่น (Fabric Warehouse, ฐานข้อมูล Fabric SQL, Azure SQL, Snowflake, KQL, Azure Data Lake Storage รุ่น2, ปลายทางของไฟล์) ตัวเลือกจะไม่มีผล
  • ถ้าคุณปิดการจัดเตรียมสําหรับแบบสอบถาม เส้นทางการคัดลอกที่ปรับให้เหมาะสมจะไม่นําไปใช้กับแบบสอบถามนั้น
  • ตัวเลือกนี้ใช้กับคิวรีที่มีคุณสมบัติครบถ้วนทั้งหมดในกระแสข้อมูล ไม่มีการแทนที่ต่อคิวรีในวันนี้

เปิดใช้งานการบีบอัด V-Order (พรีวิว)

V-Order เป็นการเพิ่มประสิทธิภาพเวลาเขียนสําหรับรูปแบบไฟล์ Parquet ที่ปรับปรุงประสิทธิภาพการอ่านสําหรับกลไก Fabric ดาวน์สตรีม โดยมีค่าใช้จ่ายของ CPU เพิ่มเติมในระหว่างการเขียน สําหรับคําแนะนําเบื้องหลังและข้ามกลไกจัดการ โปรดดู การเพิ่มประสิทธิภาพตาราง Delta Lake และ การบํารุงรักษาและการเพิ่มประสิทธิภาพตาราง V-Order และ Cross-workload

เมื่อเปิดตัวเลือกนี้ Dataflow Gen2 จะใช้การบีบอัด V-Order กับข้อมูลที่เขียนไปยัง Lakehouse ที่จัดเตรียม เมื่อปิดอยู่ ข้อมูลที่จัดเตรียมไว้จะถูกเขียนโดยไม่มี V-Order

เมื่อใดควรเปิดหรือปิด V-Order สําหรับการแสดงละคร

การจัดเตรียม Lakehouse เก็บข้อมูลระดับกลางที่ใช้โดย Dataflow Gen2 เท่านั้น: กระแสข้อมูลจะอ่านข้อมูลที่จัดลําดับขั้นอีกครั้งในระหว่างการรีเฟรชเดียวกันเพื่อใช้การแปลงเพิ่มเติมหรือเพื่อเขียนไปยังปลายทาง และตัวเชื่อมต่อกระแสข้อมูลจะอ่านจากข้อมูลที่จัดลําดับขั้นเมื่อรายการอื่นคิวรีผลลัพธ์ของกระแสข้อมูล กลไกจัดการคิวรีของผู้ใช้ปลายทาง (Power BI Direct Lake, Fabric Warehouse, จุดสิ้นสุดการวิเคราะห์ SQL, Spark) ไม่อ่าน Lakehouse การจัดเตรียมโดยตรง สถานการณ์เหล่านั้นใช้กับ ปลายทางข้อมูล Lakehouse ของคุณแทน สําหรับคําแนะนําปลายทาง โปรดดู เปิดใช้งานการบีบอัด V-Order บนปลายทาง Lakehouse

เนื่องจากโดยทั่วไปแล้วข้อมูลที่จัดลําดับขั้นจะถูกอ่านจํานวนครั้งน้อยภายในการรีเฟรชเดียวกัน การ ปิด V-Order สําหรับการจัดเตรียมจึงเป็นตัวเลือกที่ดีสําหรับกระแสข้อมูลส่วนใหญ่ การข้าม V-Order ช่วยลดเวลาในการเขียน CPU และลดระยะเวลาการรีเฟรช โดยเฉพาะอย่างยิ่งสําหรับการเขียน stag จขนาดใหญ่ พิจารณาเปิด V-Order สําหรับการ จัดเตรียมหากเอาต์พุตที่จัดลําดับขั้นของกระแสข้อมูลถูกใช้หลายครั้งผ่านตัวเชื่อมต่อกระแสข้อมูล และคุณต้องการสนับสนุนประสิทธิภาพการอ่านสําหรับคิวรีดาวน์สตรีมเหล่านั้นมากกว่าต้นทุนการเขียนการจัดเตรียม

การทำงานตามค่าเริ่มต้น

ตัวเลือกจะเปิดอยู่ตามค่าเริ่มต้น ใช้คําแนะนําด้านบนเพื่อตัดสินใจว่าสิ่งใดเหมาะสมกับกระแสข้อมูลของคุณ

V-Order ใช้ที่ไหนอีก

นอกเหนือจากการตั้งค่าระดับกระแสข้อมูลที่ควบคุมการจัดเตรียม Lakehouse แล้ว V-Order ยังสามารถควบคุมได้บนการเชื่อมต่อปลายทางข้อมูล Lakehouse เอง ผ่านตัวเลือกขั้นสูง เปิดใช้งานการใช้การบีบอัด V-Order การตั้งค่านั้นจะควบคุมว่าข้อมูลที่เขียนไปยัง Lakehouse ปลายทางจะถูกบีบอัด V-Order หรือไม่ ปลายทางคือพื้นผิวที่อ่านโดย Direct Lake, Fabric Warehouse, จุดสิ้นสุดการวิเคราะห์ SQL และ Spark ดังนั้นคําแนะนําระดับปลายทางจึงขึ้นอยู่กับสถานการณ์

สําหรับรายละเอียดเกี่ยวกับตัวเลือกระดับปลายทาง โปรดดู เปิดใช้งานการบีบอัด V-Order บนปลายทาง Lakehouse