Criar e gerir serviços modelo

Importante

Este recurso está em versão Beta. Os administradores de conta podem controlar o acesso a esta funcionalidade a partir da página de Pré-visualizações da consola da conta. Ver Gerir as pré-visualizações de Azure Databricks.

Esta página descreve como criar, partilhar e gerir serviços modelo no Unity Catalog.

Requirements

  • Pré-visualização do Unity AI Gateway ativada para a sua conta. Ver Gerir as pré-visualizações de Azure Databricks.
  • Um espaço de trabalho Azure Databricks numa região suportada por Unity AI Gateway.
  • Unity Catalog ativado para o seu espaço de trabalho. Consulte Habilitar um espaço de trabalho para o Unity Catalog.
  • Para criar um serviço modelo, deve ter:
    • USE CATALOG, USE SCHEMA e CREATE SERVICE no catálogo e no esquema onde cria o serviço de modelo.
    • EXECUTE em cada modelo que o serviço de modelos referencia como destino.
    • EXECUTE, USE CATALOG e USE SCHEMA em cada serviço do fornecedor do modelo que o serviço de modelos referencia como destino.
    • USE CATALOG, USE SCHEMA e CREATE TABLE no catálogo e no esquema onde a tabela de inferência é criada, caso ative o registo de inferência.

Criar um serviço modelo

Pode criar um serviço modelo na interface do Unity AI Gateway ou no Explorador de Catálogos.

Os serviços modelo e os serviços de fornecedor de modelos partilham um único espaço de nomes dentro de um esquema do Catálogo Unity. Não podes usar um nome para um serviço de modelo se um serviço de fornecedor de modelos no esquema já utilizar esse nome, e vice-versa.

Usar a interface do usuário

  1. Proceda de uma das seguintes formas:
    • Na barra lateral do espaço de trabalho, clique em AI Gateway e depois em Criar.
    • No Catalog Explorer, vá para o esquema onde pretende criar o serviço de modelo e, em seguida, clique em Criar>Serviço>Serviço de modelo.
  2. Introduza um nome para o serviço de modelo e selecione o catálogo e o esquema para o criar. Se começares pelo Explorador de Catálogos, o Explorador de Catálogos prepreenche o catálogo e o esquema.
  3. Selecione o destino principal a servir. Este destino pode ser um modelo alojado pela Databricks no qual tem EXECUTE ativo e que o Unity AI Gateway pode disponibilizar, ou um serviço de fornecedor de modelos no qual tem EXECUTE, USE CATALOG e USE SCHEMA ativos.
  4. Clique em Criar.

Depois de criar o serviço de modelo, o Azure Databricks abre a sua página de visão geral, onde pode começar ou configurar funcionalidades adicionais, como registo de inferências.

Conceder acesso a um serviço modelo

Para permitir que outros consultem um serviço modelo, conceda-lhes EXECUTE no serviço modelo e USE CATALOGUSE SCHEMA no seu catálogo e esquema. Se o serviço de modelo registar dados numa tabela de inferência, conceda SELECT na tabela para lhes permitir ler os pedidos e as respostas registados.

Para conceder acesso no Explorador de Catálogos:

  1. No Explorador de Catálogos, abra o serviço de modelos.
  2. Na guia Permissões, clique em Conceder.
  3. Selecione os utilizadores ou grupos a conceder acesso, selecione o EXECUTE privilégio e clique em Conceder.

Certifique-se de que os mesmos princípios também estão USE CATALOGUSE SCHEMA presentes no catálogo e esquema do serviço modelo. Para permitir que leiam as solicitações e respostas registadas, conceda SELECT na tabela de inferência no respetivo separador Permissões.

Para saber mais sobre como conceder e descobrir acessos, veja governar serviços de modelo.

Configurar funcionalidades num serviço modelo

Configuras funcionalidades como limites de taxa, registo de inferências e guardrails no serviço de modelos a partir da interface do Unity AI Gateway, da mesma forma que as configuras num endpoint do Unity AI Gateway. See:

Registo de inferência

Quando ativas o registo de inferências, o Azure Databricks cria uma nova tabela vazia do Unity Catalog com um esquema pré-definido no local que especificas. Tenha em atenção o seguinte::

  • Tem de ter USE CATALOG, USE SCHEMA e CREATE TABLE no catálogo e no esquema de destino.
  • O criador do serviço modelo é o proprietário da tabela de inferência. Nenhum outro utilizador tem acesso a menos que o concedas.
  • Se uma tabela já existir na localização especificada, a criação do serviço modelo falha.
  • A tabela de inferência tem um ciclo de vida independente do serviço modelo. Se eliminares a tabela, o serviço do modelo continua a funcionar, mas deixa de registar.

Para mais informações sobre tabelas de inferência, consulte Monitorizar serviços de modelos usando tabelas de inferência.

Eliminar um serviço modelo

Para eliminar um serviço modelo, deve ter pelo menos o MANAGE privilégio sobre ele. O proprietário tem um superconjunto de MANAGE.

Para eliminar um serviço de modelo, abre-o no Explorador de Catálogos e selecione Eliminar no menu kebab.

Os serviços modelo fornecidos pelo sistema em system.ai não podem ser eliminados.

Passos seguintes