หมายเหตุ
การเข้าถึงหน้านี้ต้องได้รับการอนุญาต คุณสามารถลอง ลงชื่อเข้าใช้หรือเปลี่ยนไดเรกทอรีได้
การเข้าถึงหน้านี้ต้องได้รับการอนุญาต คุณสามารถลองเปลี่ยนไดเรกทอรีได้
Note
ตัวเลือกข้อมูลที่จัดเป็นระยะที่อธิบายไว้ในบทความนี้อยู่ในการแสดงตัวอย่าง
เมื่อคุณเปิดใช้งาน staging ในคิวรี กระแสข้อมูล Gen2 จะเขียนผลลัพธ์ระดับกลางไปยัง Lakehouse การจัดเตรียมภายใน เพื่อให้กลไกจัดการสามารถใช้การคํานวณ Fabric สําหรับการแปลงหรือส่งข้อมูลไปยังปลายทางได้
ส่วน ข้อมูลแบบเป็นลําดับขั้น ในการตั้งค่ามาตราส่วนกระแสข้อมูลช่วยให้คุณสามารถปรับแต่งสองแง่มุมของไปป์ไลน์นั้นได้:
- คัดลอกที่ปรับให้เหมาะสมไปยัง Lakehouse (พรีวิว) — ใช้เส้นทางที่เร็วขึ้นเพื่อเขียนข้อมูลที่จัดเตรียมไปยังปลายทางข้อมูล Fabric Lakehouse
- เปิดใช้งานการบีบอัด V-Order (พรีวิว) — ใช้การบีบอัด V-Order กับข้อมูลที่เขียนไปยังเลคเฮาส์ที่จัดเตรียมไว้
ทั้งสองตัวเลือกมีผลที่ระดับกระแสข้อมูลและมีผลเฉพาะในกระแสข้อมูล Gen2 เท่านั้น
จะหาการตั้งค่าได้ที่ไหน
- เปิดกระแสข้อมูลของคุณในตัวแก้ไข Power Query
- เลือก ตัวเลือก จากเมนู
- ไปที่แท็บมาตราส่วน
- การตั้งค่าทั้งสองจะแสดงอยู่ภายใต้ ข้อมูลที่จัดลําดับ
คัดลอกที่ปรับให้เหมาะสมไปยัง Lakehouse (พรีวิว)
เมื่อเปิดตัวเลือกนี้ กระแสข้อมูล Gen2 จะใช้เส้นทางการเคลื่อนย้ายข้อมูลที่ปรับให้เหมาะสมสําหรับคิวรีที่:
- เปิดใช้งาน การแสดงละคร และ
- เขียนไปยังปลายทางข้อมูล Fabric Lakehouse
ในเส้นทางเริ่มต้น ข้อมูลจะไหลจากคลังสินค้าการจัดเตรียมไปยังเลคเฮาส์ด้วยการทําให้เป็นอนุกรมและการกระโดดเครือข่ายเพิ่มเติม เส้นทางที่ปรับให้เหมาะสมช่วยลดการกระโดดเหล่านั้น ซึ่งสามารถลดเวลาการรีเฟรชได้อย่างมากสําหรับกระแสข้อมูลที่หนักหน่วงซึ่งลงจอดใน Lakehouse
สําหรับตัวอย่างที่วัดได้เกี่ยวกับผลกระทบของเวลารีเฟรชและการใช้ CU ของตัวเลือกนี้ ดูที่ สถานการณ์ที่ 3: การคัดลอกที่ปรับแต่งไปยัง Lakehouse ในมาตรฐานต้นทุนและประสิทธิภาพ Dataflow Gen2
เวลาที่ใช้
เปิดสิ่งนี้เมื่อคุณจัดเตรียมคิวรีที่ในที่สุดก็เข้าสู่ปลายทางข้อมูล Fabric Lakehouse การแสดงละครจะมีประโยชน์มากที่สุดเมื่อ:
- คิวรีของคุณมีการแปลงที่ไม่พับไปยังแหล่งที่มา
- คุณต้องการพึ่งพาการคํานวณการจัดเตรียม Fabric (Lakehouse หรือ Warehouse) เพื่อเรียกใช้การดําเนินการที่หนักหน่วง เช่น การรวม การจัดกลุ่มตาม หรือตัวกรองก่อนที่จะเขียนไปยังปลายทาง
สําหรับข้อมูลเพิ่มเติมเกี่ยวกับวิธีใช้การจัดเตรียม โปรดดู แนวทางปฏิบัติที่ดีที่สุดเพื่อให้ได้ประสิทธิภาพที่ดีที่สุดด้วย Dataflow Gen2
การทำงานตามค่าเริ่มต้น
ตัวเลือกจะปิดอยู่ตามค่าเริ่มต้น สําหรับกระแสข้อมูลส่วนใหญ่ที่จัดเตรียมข้อมูลและเขียนไปยัง Fabric Lakehouse การเปิดตัวเลือกนี้จะเป็นประโยชน์
ข้อควรพิจารณา
- ตัวเลือกนี้จะมีผลเฉพาะกับคิวรีที่เปิดใช้งานการจัดเตรียมและเขียนไปยังปลายทางข้อมูล Fabric Lakehouse เท่านั้น สําหรับคิวรีที่เขียนไปยังปลายทางอื่น (Fabric Warehouse, ฐานข้อมูล Fabric SQL, Azure SQL, Snowflake, KQL, Azure Data Lake Storage รุ่น2, ปลายทางของไฟล์) ตัวเลือกจะไม่มีผล
- ถ้าคุณปิดการจัดเตรียมสําหรับแบบสอบถาม เส้นทางการคัดลอกที่ปรับให้เหมาะสมจะไม่นําไปใช้กับแบบสอบถามนั้น
- ตัวเลือกนี้ใช้กับคิวรีที่มีคุณสมบัติครบถ้วนทั้งหมดในกระแสข้อมูล ไม่มีการแทนที่ต่อคิวรีในวันนี้
เปิดใช้งานการบีบอัด V-Order (พรีวิว)
V-Order เป็นการเพิ่มประสิทธิภาพเวลาเขียนสําหรับรูปแบบไฟล์ Parquet ที่ปรับปรุงประสิทธิภาพการอ่านสําหรับกลไก Fabric ดาวน์สตรีม โดยมีค่าใช้จ่ายของ CPU เพิ่มเติมในระหว่างการเขียน สําหรับคําแนะนําเบื้องหลังและข้ามกลไกจัดการ โปรดดู การเพิ่มประสิทธิภาพตาราง Delta Lake และ การบํารุงรักษาและการเพิ่มประสิทธิภาพตาราง V-Order และ Cross-workload
เมื่อเปิดตัวเลือกนี้ Dataflow Gen2 จะใช้การบีบอัด V-Order กับข้อมูลที่เขียนไปยัง Lakehouse ที่จัดเตรียม เมื่อปิดอยู่ ข้อมูลที่จัดเตรียมไว้จะถูกเขียนโดยไม่มี V-Order
เมื่อใดควรเปิดหรือปิด V-Order สําหรับการแสดงละคร
การจัดเตรียม Lakehouse เก็บข้อมูลระดับกลางที่ใช้โดย Dataflow Gen2 เท่านั้น: กระแสข้อมูลจะอ่านข้อมูลที่จัดลําดับขั้นอีกครั้งในระหว่างการรีเฟรชเดียวกันเพื่อใช้การแปลงเพิ่มเติมหรือเพื่อเขียนไปยังปลายทาง และตัวเชื่อมต่อกระแสข้อมูลจะอ่านจากข้อมูลที่จัดลําดับขั้นเมื่อรายการอื่นคิวรีผลลัพธ์ของกระแสข้อมูล กลไกจัดการคิวรีของผู้ใช้ปลายทาง (Power BI Direct Lake, Fabric Warehouse, จุดสิ้นสุดการวิเคราะห์ SQL, Spark) ไม่อ่าน Lakehouse การจัดเตรียมโดยตรง สถานการณ์เหล่านั้นใช้กับ ปลายทางข้อมูล Lakehouse ของคุณแทน สําหรับคําแนะนําปลายทาง โปรดดู เปิดใช้งานการบีบอัด V-Order บนปลายทาง Lakehouse
เนื่องจากโดยทั่วไปแล้วข้อมูลที่จัดลําดับขั้นจะถูกอ่านจํานวนครั้งน้อยภายในการรีเฟรชเดียวกัน การ ปิด V-Order สําหรับการจัดเตรียมจึงเป็นตัวเลือกที่ดีสําหรับกระแสข้อมูลส่วนใหญ่ การข้าม V-Order ช่วยลดเวลาในการเขียน CPU และลดระยะเวลาการรีเฟรช โดยเฉพาะอย่างยิ่งสําหรับการเขียน stag จขนาดใหญ่ พิจารณาเปิด V-Order สําหรับการ จัดเตรียมหากเอาต์พุตที่จัดลําดับขั้นของกระแสข้อมูลถูกใช้หลายครั้งผ่านตัวเชื่อมต่อกระแสข้อมูล และคุณต้องการสนับสนุนประสิทธิภาพการอ่านสําหรับคิวรีดาวน์สตรีมเหล่านั้นมากกว่าต้นทุนการเขียนการจัดเตรียม
การทำงานตามค่าเริ่มต้น
ตัวเลือกจะเปิดอยู่ตามค่าเริ่มต้น ใช้คําแนะนําด้านบนเพื่อตัดสินใจว่าสิ่งใดเหมาะสมกับกระแสข้อมูลของคุณ
V-Order ใช้ที่ไหนอีก
นอกเหนือจากการตั้งค่าระดับกระแสข้อมูลที่ควบคุมการจัดเตรียม Lakehouse แล้ว V-Order ยังสามารถควบคุมได้บนการเชื่อมต่อปลายทางข้อมูล Lakehouse เอง ผ่านตัวเลือกขั้นสูง เปิดใช้งานการใช้การบีบอัด V-Order การตั้งค่านั้นจะควบคุมว่าข้อมูลที่เขียนไปยัง Lakehouse ปลายทางจะถูกบีบอัด V-Order หรือไม่ ปลายทางคือพื้นผิวที่อ่านโดย Direct Lake, Fabric Warehouse, จุดสิ้นสุดการวิเคราะห์ SQL และ Spark ดังนั้นคําแนะนําระดับปลายทางจึงขึ้นอยู่กับสถานการณ์
สําหรับรายละเอียดเกี่ยวกับตัวเลือกระดับปลายทาง โปรดดู เปิดใช้งานการบีบอัด V-Order บนปลายทาง Lakehouse
เนื้อหาที่เกี่ยวข้อง
- เกณฑ์มาตรฐานต้นทุนและประสิทธิภาพของ Dataflow Gen2
- แนวทางปฏิบัติที่ดีที่สุดสําหรับการทํางานที่ดีที่สุดด้วย Dataflow Gen2
- ปลายทางข้อมูล Dataflow Gen2 และการตั้งค่าที่มีการจัดการ
- การปรับตาราง Delta Lake ให้เหมาะสมและ V-Order
- การบํารุงรักษาและการเพิ่มประสิทธิภาพตารางปริมาณงานข้าม
- Modern Evaluator สําหรับ Dataflow Gen2 พร้อม CI/CD
- ใช้การคํานวณแบบแบ่งพาร์ติชันในกระแสข้อมูล Gen2 (พรีวิว)