O que é uma fonte de conhecimento?

Nota

Pesquisa de IA do Azure  está disponível por meio do portal Azure, APIs REST e SDKs do Azure. Ele também sustenta o IQ do Foundry, a camada de conhecimento gerenciado que transforma o conteúdo da empresa em bases de conhecimento reutilizáveis e com reconhecimento de permissão para agentes no portal do Microsoft Foundry.

Nota

Alguns recursos de recuperação agêntica já estão disponíveis na API REST versão 2026-04-01 via acesso programático. O portal do Azure e o portal do Microsoft Foundry continuam fornecendo acesso apenas em versão prévia a todos os recursos de recuperação por agentes. Para obter diretrizes de migração, incluindo um detalhamento do que está disponível em geral e o que permanece na versão preliminar, consulte Migrar o código de recuperação por meio de agentes para a versão mais recente.

Se você optar por usar uma API REST em versão prévia, poderá acessar recursos de recuperação agêntica que ainda não estão disponíveis de forma geral. Os recursos de pré-visualização são fornecidos sem um contrato de nível de serviço e não são recomendados para trabalhos em ambientes de produção. Para obter mais informações, consulte Termos de Uso Complementares para Versões Prévias do Microsoft Azure.

Importante

Esses recursos e funcionalidades fazem parte da API REST 2026-05-01-preview. O 2026-05-01-preview é licenciado para você como parte da sua assinatura do Azure e está sujeito aos termos aplicáveis a "Versões Prévias" nos Termos do Produto Microsoft, no Adendo de Proteção de Dados de Produtos e Serviços da Microsoft ("DPA") e nos Termos de Uso Suplementares para Versões Prévias do Microsoft Azure.

A versão prévia 2026-05-01 dá suporte a conexões com outros serviços de serviços Microsoft e de terceiros. O uso desses serviços está sujeito aos respectivos termos e pode resultar em processamento ou armazenamento de dados fora do limite de conformidade Azure, bem como dados que fluem para o limite de conformidade Azure.

É sua responsabilidade gerenciar se os seus dados serão transferidos para fora dos limites geográficos e de conformidade da sua organização, bem como quaisquer implicações relacionadas, e garantir que as permissões, os limites e as aprovações apropriados estejam devidamente estabelecidos.

Você é responsável por examinar e testar cuidadosamente os aplicativos que cria no contexto de seus casos de uso específicos e tomar todas as decisões e personalizações apropriadas. Isso inclui implementar suas próprias mitigações de IA responsáveis, como metaprompts, filtros de conteúdo ou outros sistemas de segurança, e garantir que seus aplicativos atendam aos padrões adequados de qualidade, confiabilidade, segurança e confiabilidade. Para obter mais informações, consulte a Pesquisa de IA do Azure  Nota de Transparência.

Uma fonte de conhecimento é um recurso de nível superior no serviço Pesquisa de IA do Azure que define o conteúdo utilizado em um pipeline de recuperação por meio de agentes. Cada fonte de conhecimento é indexada ou remota, o que determina como o conteúdo é ingerido, processado e consultado. Fontes de conhecimento são componentes necessários de uma base de dados de conhecimento.

Você pode referenciar várias fontes de conhecimento em uma única base de dados de conhecimento. O mecanismo de recuperação agêntico consulta todas em uma única requisição. As subconsultas são geradas para cada fonte de conhecimento e os principais resultados são retornados na resposta de recuperação.

Fontes de conhecimento com suporte

Pesquisa de IA do Azure  oferece suporte às seguintes fontes de conhecimento para cargas de trabalho de recuperação agêntica.

Variante Description Indexado ou remoto
Índice de pesquisa Encapsula um índice existente. Indexado
Azure Blob Gera um pipeline de indexação a partir de um contêiner de blobs. Indexado
SQL do Azure (versão prévia) Gera um pipeline de indexação a partir de uma tabela ou exibição do SQL do Azure. Indexado
Arquivo (versão prévia) Carrega arquivos diretamente para Pesquisa de IA do Azure . Indexado
OneLake Gera um pipeline do indexador a partir de uma lakehouse. Indexado
SharePoint indexado (versão prévia) Gera um pipeline do indexador a partir de um site do SharePoint. Indexado
SharePoint remoto (versão prévia) Recupera o conteúdo de SharePoint. Remoto
Fabric Data Agent (versão prévia) Recupera respostas e recursos inseridos de um agente de dados Microsoft Fabric. Remoto
Fabric Ontologia (versão prévia) Obtém respostas baseadas em entidades e relacionamentos de uma ontologia do Microsoft Fabric. Remoto
Servidor MCP (versão prévia) Recupera resultados dinâmicos com suporte de ferramentas de um servidor MCP externo. Remoto
Qi de Trabalho (versão prévia) Recupera a inteligência organizacional do IQ do Trabalho. Remoto
Web Recupera dados de aterramento em tempo real de Microsoft Bing. Remoto

Fontes de conhecimento indexadas

Uma fonte de conhecimento indexada aponta para um índice de pesquisa que atende aos critérios de recuperação agêntica. O conteúdo é ingerido no índice antes do tempo de consulta por um dos três caminhos:

  • Traga seu próprio índice: use uma fonte de conhecimento de índice de pesquisa para encapsular um índice existente em seu serviço de pesquisa.

  • Carregamento direto de arquivos: Use uma fonte de conhecimento de arquivos para carregar arquivos diretamente para o Pesquisa de IA do Azure . O serviço processa os arquivos e armazena o conteúdo extraído em um índice de pesquisa gerado, sem necessidade de pipeline de indexador ou armazenamento externo.

  • Pipeline do indexador gerado automaticamente: Para todas as outras fontes de conhecimento indexadas, Pesquisa de IA do Azure  cria automaticamente um pipeline de indexador completo de sua fonte de dados externa. Isso inclui uma fonte de dados, um conjunto de habilidades, um indexador e um índice preenchido e segmentado.

As consultas são executadas localmente em seu serviço de pesquisa usando palavras-chave (texto completo), vetor ou consultas híbridas.

Fontes de conhecimento remoto

Uma fonte de conhecimento remota se conecta diretamente a uma plataforma externa. O conteúdo nunca é importado para o Pesquisa de IA do Azure . Em vez disso, ele é recuperado no momento da consulta por meio das APIs nativas de cada plataforma. O mecanismo de recuperação agêntica faz a chamada à API e retorna os resultados junto com quaisquer fontes de conhecimento indexadas na mesma resposta.

Dependendo da plataforma, as conexões remotas acessam o conteúdo pela internet pública (como o Bing) ou dentro do seu tenant da Microsoft (como SharePoint e Fabric).

Classificação unificada

Para fontes de conhecimento indexadas e remotas, todo o conteúdo recuperado flui pelo mesmo pipeline de classificação. Os resultados são pontuados por relevância, mesclados entre consultas e reclassificados antes de retornarem na resposta de recuperação.

Trabalhando com fontes de conhecimento

Fontes de conhecimento são objetos independentes que você cria e gerencia separadamente das bases de dados de conhecimento. Tenha o seguinte em mente:

  • Crie uma fonte de conhecimento antes de criar uma base de dados de conhecimento. As bases de dados de conhecimento fazem referência a fontes de conhecimento por ID, portanto, a fonte de conhecimento deve existir primeiro.

  • Para excluir uma fonte de conhecimento, primeiro atualize ou exclua quaisquer bases de dados de conhecimento que façam referência a ela. Em seguida, você pode excluir a fonte de conhecimento.

  • Uma fonte de conhecimento e sua base de dados de conhecimento devem existir no mesmo serviço de pesquisa.

Criando fontes de conhecimento

Para criar uma fonte de conhecimento, você precisa de permissões de Colaborador do Serviço de Pesquisa em seu serviço de pesquisa. Se a fonte de conhecimento gerar um pipeline do indexador, você também precisará de permissões de Colaborador de Dados do Índice de Pesquisa para carregar um índice. Você pode usar uma chave de API de administrador como alternativa às atribuições de função.

O suporte à criação no portal Azure, no portal do Microsoft Foundry, na API REST e no SDKs do Azure varia de acordo com o tipo de fonte de conhecimento. Para obter instruções por tipo, consulte os links em fontes de conhecimento com suporte.

Rótulos de confidencialidade de ingestão (versão prévia)

Para o blob, o OneLake indexado e as fontes de conhecimento de SharePoint indexadas, você pode ingerir rótulos de confidencialidade do Microsoft Purview definindo ingestionPermissionOptions para incluir sensitivityLabel. Siga todos os pré-requisitos antes de definir esse valor. Depois que eles são sincronizados com o índice, os rótulos são exibidos em respostas de recuperação e usados para impor o acesso no nível do documento no momento da consulta. Para obter mais informações, consulte Impor permissões no momento da consulta (versão prévia).

Se a fonte de conhecimento indexada usar um índice fragmentado, por exemplo, com vetorização integrada ou uma habilidade personalizada de Divisão de Texto, você também deve mapear o rótulo de confidencialidade para a linha de cada fragmento por meio de projeções de índice no conjunto de habilidades. Caso contrário, as referências no nível de fragmento nas respostas de recuperação não serão retornadas se essas referências tiverem rótulos no documento de origem.

Exibir imagens incorporadas em documentos (versão prévia)

Para fontes de conhecimento de blob, OneLake indexado e SharePoint indexado, você pode configurar um assetStore no ingestionParameters da fonte de conhecimento para persistir imagens incorporadas aos seus documentos de origem. Quando você também habilita a disponibilização de imagens na base de conhecimento, a ação retrieve injeta essas imagens no prompt de síntese da resposta para que o LLM possa raciocinar sobre diagramas, gráficos e conteúdo extraído das imagens. Para obter mais informações, consulte Exibir imagens incorporadas em documentos na recuperação por meio de agentes (versão prévia).

Não configure assetStore e ingestionPermissionOptions na mesma fonte de conhecimento. O fornecimento de imagens não é compatível quando ingestionPermissionOptions está configurado.

Usando fontes de conhecimento

Depois de criar uma fonte de conhecimento, faça referência a ela em uma base de dados de conhecimento. A base de dados de conhecimento determina quais fontes de conhecimento consultar. As seções a seguir descrevem opções para controlar quais fontes estão incluídas e como o mecanismo seleciona entre elas.

Sempre consultar uma fonte de conhecimento

Defina alwaysQuery como true em uma definição de origem de conhecimento para incluí-la em todas as consultas, independentemente do nível de esforço de raciocínio de recuperação.

Usar o esforço de raciocínio de recuperação para controlar o uso de LLM (versão prévia)

O esforço de raciocínio de recuperação controla a quantidade de processamento de LLM aplicada a cada consulta. Nem todas as soluções se beneficiam do planejamento de consultas LLM. Se a simplicidade e a velocidade forem a prioridade, use minimal o esforço para ignorar o processamento de LLM. Nos níveis de esforço low e medium, o LLM planeja e seleciona quais fontes de conhecimento consultar, sendo que medium adiciona uma passagem iterativa para resultados mais aprofundados. Para obter mais informações sobre cada nível, consulte Definir o esforço de raciocínio de recuperação (versão prévia).

Os seguintes fatores orientam a seleção em low e com esforço medium:

  • name da fonte de conhecimento.

  • O description de um índice (para fontes de conhecimento indexadas).

  • O retrievalInstructions especificado na definição da base de conhecimento ou na ação de recuperação. As instruções de recuperação orientam quais fontes de conhecimento o LLM seleciona ou ignora. Eles funcionam como um prompt: você pode especificar brevidade, tom e formatação.