Megjegyzés
Az oldalhoz való hozzáféréshez engedély szükséges. Megpróbálhat bejelentkezni vagy módosítani a címtárat.
Az oldalhoz való hozzáféréshez engedély szükséges. Megpróbálhatja módosítani a címtárat.
Ez a cikk bemutatja, hogyan engedélyezheti a modellszolgáltatást a munkaterületen, és hogyan válthat modelljeit kiszolgáló nélküli számításra épülő modellszolgáltatásra .
Fontos
2025. augusztus 22-től az ügyfelek már nem hozhatnak létre új kiszolgáló végpontokat a Legacy MLflow Model Serving élmény használatával. 2025. szeptember 15-én a régi élmény életciklusának végére került, és az összes meglévő végpont, amely ezt a szolgáltatást használja, már nem használható.
Követelmények
- Regisztrált modell az MLflow-modell beállításjegyzékében.
- A regisztrált modellekre vonatkozó engedélyek a hozzáférés-vezérlési útmutatóban leírtak szerint.
- Kiszolgáló nélküli számítás engedélyezése a munkaterületen.
Jelentős változások
- A modellkiszolgálóban a végpontra irányuló kérés formátuma és a végpont válasza kissé eltér az örökölt MLflow modellkiszolgálótól. Az új formátumprotokoll részleteiért tekintse meg a modellvégpont pontozását.
- A Modellkiszolgálóban a végpont URL tartalmazza a
serving-endpoints-t ahelyett, hogymodel-t. - A modellkiszolgáló teljes körű támogatást nyújt az erőforrások API-munkafolyamatokkal történő kezeléséhez.
- A modellkiszolgálás éles üzemre kész, és az Azure Databricks SLA támogatja.
Az örökölt MLflow modellkiszolgálót használó kiszolgáló végpontok azonosítása
Az örökölt MLflow modellkiszolgálót használó modellkiszolgáló végpontok azonosítása:
- Navigáljon a munkaterületén található Modellek felületre.
- Válassza ki a munkaterületmodell beállításjegyzék-szűrőt .
- Válassza ki a(z) Csak az örökölt kiszolgálás engedélyezve szűrőt.
Az örökölt MLflow modellek átköltöztetése a Model Serving szolgáltatásra
Létrehozhat egy modellkiszolgáló végpontot és rugalmasan átalakíthatja a modellkiszolgáló munkafolyamatokat anélkül, hogy letiltaná a régi MLflow modellkiszolgálót.
Az alábbi lépések bemutatják, hogyan valósíthatja meg ezt a felhasználói felületen. Minden olyan modell esetében, amelyen engedélyezve van az örökölt MLflow-modell-kiszolgáló:
- Regisztrálja a modellt a Unity Catalogban.
- Lépjen a Kiszolgáló végpontok elemre a gépi tanulási munkaterület oldalsávján.
- Kövesse a Saját modell kiszolgálóvégpontok létrehozása című részben leírt munkafolyamatot, hogy megtudja, miként hozhat létre egy kiszolgálóvégpontot a modellel.
- Váltsa át az alkalmazást úgy, hogy a kiszolgáló végpont által megadott új URL-címet használja a modell lekérdezéséhez, valamint az új pontozási formátumot.
- A modellek átállítás után navigálhat a gépi tanulási munkaterület oldalsávján található Modellek elemre.
- Válassza ki azt a modellt, amelyhez le szeretné tiltani az örökölt MLflow-modell kiszolgálását.
- A Kiszolgálás lapon válassza a Leállításlehetőséget.
- Megjelenik egy üzenet, amely megerősíti. Válassza szolgáltatás leállítása lehetőséget.
Üzembe helyezett modellverziók migrálása a Modellkiszolgálóba
A Modellkiszolgáló funkció korábbi verzióiban a kiszolgálóvégpont a regisztrált modellverzió fázisa alapján lett létrehozva: Staging vagy Production. Ha át szeretné migrálni a kiszolgált modelleket ebből a felületről, replikálhatja ezt a viselkedést az új modellkiszolgálói felületen.
Ez a szakasz bemutatja, hogyan hozhat létre külön modellvégpontokat a Staging modellverziók és a Production modellverziók számára. Az alábbi lépések bemutatják, hogyan valósíthatja meg ezt az egyes kiszolgált modellekhez tartozó végpontok API-jával.
A példában a regisztrált modell neve modelA az 1-es verzióval rendelkezik a Production modell fázisában, és a 2-es verzióval rendelkezik a Staging modell fázisában.
Hozzon létre két végpontot a regisztrált modellhez, egyet a modellverziókhoz
Staging, egyet pedig a modellverziókhozProduction.Modellverziók esetén
Staging:POST /api/2.0/serving-endpoints { "name":"modelA-Staging" "config": { "served_entities": [ { "entity_name":"model-A", "entity_version":"2", // Staging Model Version "workload_size":"Small", "scale_to_zero_enabled":true }, ], }, }Modellverziók esetén
Production:POST /api/2.0/serving-endpoints { "name":"modelA-Production" "config": { "served_entities": [ { "entity_name":"model-A", "entity_version":"1", // Production Model Version "workload_size":"Small", "scale_to_zero_enabled":true }, ], }, }Ellenőrizze a végpontok állapotát.
Átmeneti végpont esetén:
GET /api/2.0/serving-endpoints/modelA-StagingÉles végpont esetén:
GET /api/2.0/serving-endpoints/modelA-ProductionMiután elkészültek a végpontok, a következővel kérdezheti le a végpontot:
Átmeneti végpont esetén:
POST /serving-endpoints/modelA-Staging/invocationsÉles végpont esetén:
POST /serving-endpoints/modelA-Production/invocationsFrissítse a végpontot a modellverzió-áttűnések alapján.
Abban az esetben, amikor létrejön egy új 3. modellverzió, a 2. modellverzió áttérhet
Production-ra, amíg a 3. modellverzió áttérhetStaging-re, és az 1. modellverzióArchived-re vált. Ezek a módosítások a végpontokat kiszolgáló különálló modellben az alábbiak szerint jelenhetnek meg:A
Stagingvégpont esetében frissítse azt az új modellverzióra aStaging-ben.PUT /api/2.0/serving-endpoints/modelA-Staging/config { "served_entities": [ { "entity_name":"model-A", "entity_version":"3", // New Staging model version "workload_size":"Small", "scale_to_zero_enabled":true }, ], }A
Productionvégpont frissítésekor állítsa be, hogy az új modellverziót használja aProduction-ben.PUT /api/2.0/serving-endpoints/modelA-Production/config { "served_entities": [ { "entity_name":"model-A", "entity_version":"2", // New Production model version "workload_size":"Small", "scale_to_zero_enabled":true }, ], }