Сводка по источникам знаний

Источники знаний закрепляют ответы ваших агентов на корпоративных данных. Когда вы добавляете источники знаний, агенты могут использовать корпоративные данные из Power Platform, данных Dynamics 365, веб-сайтов и внешних систем. Используя источники знаний, ваши агенты могут предоставлять вашим клиентам релевантную информацию и инсайты.

Вы можете включать источники знаний в агенты при их первоначальном создании или добавить их уже после создания агента.

Опубликованные агенты, содержащие знания, используют настроенные источники знаний для обоснования ответов опубликованного агента. Вы можете интегрировать знания на уровне агента, на странице Знания, или на уровне темы, через узел генеративных ответов в теме агента.

В Copilot Studio также можно добавить источники знаний в узел генеративных ответов.

Поддерживаемые источники знаний

Имя Исходный материал Description Количество входных данных, поддерживаемых в генеративных ответах Authentication
Общедоступный веб-сайт External Выполняет поиск по входным запросам в Bing, возвращает результаты только с предоставленных веб-сайтов Генеративный режим: 25 веб-сайтов
Классический режим: четыре общедоступных URL-адреса (например, microsoft.com)
Нет
Documents Internal Выполняет поиск в документах, загруженных в Dataverse, и возвращает результаты из их содержимого Генеративный режим: все документы
Классический режим: ограничен объемом хранилища файлов Dataverse
Нет
Sharepoint Internal Подключается к URL-адресу SharePoint, использует GraphSearch для возврата результатов Генеративный режим: 25 URL-адресов
Классический режим: четыре URL-адреса на узел темы генеративных ответов
Проверка подлинности пользователя агента через Microsoft Entra ID
Dataverse Internal Подключается к настроенной среде Dataverse и использует генеративную модель с дополнением на основе поиска в Dataverse для возврата результатов Генеративный режим: Без ограничений
Классический режим: два источника знаний Dataverse (и до 15 таблиц на каждый источник знаний)
Проверка подлинности пользователя агента через Microsoft Entra ID
Корпоративные данные, использующие соединители Internal Подключается к соединителям, в которых данные вашей организации индексируются с помощью Поиска (Майкрософт) Генеративный режим: Без ограничений
Классический режим: два на пользовательский агент
Проверка подлинности пользователя агента через Microsoft Entra ID

Note

  • Аутентификация пользователей агента для источников базы знаний означает, что когда конкретный пользователь задает вопрос агенту, агент показывает только тот контент, к которому конкретный пользователь может получить доступ.

  • Источники знаний в узлах генеративных ответов в настоящее время не поддерживают пользовательский поиск Bing, Azure OpenAI или пользовательские данные. Вместо этого в свойствах узла генеративных ответов используйте параметр Классические данные для пользовательского поиска Bing, Azure OpenAI или источников пользовательских данных.

  • Для веб-сайтов необходимо указать, какие из них принадлежат вашей организации и будут использоваться Bing для поиска через Copilot Studio.

  • Вы можете выполнять независимые от языка запросы ко всем поддерживаемым типам файлов и языкам.

  • Если вы используете неструктурированные данные, такие как отдельные файлы и папки SharePoint, файлы и папки OneDrive или соединители, существуют разные лимиты и ограничения. Для получения дополнительной информации перейдите в раздел Лимиты и ограничения.

  • В настоящее время цитаты, возвращаемые из источника знаний, не могут использоваться как входные данные для других инструментов или действий.

Проверка подлинности источника

Если вы используете SharePoint, Dataverse или корпоративные данные с соединителями Microsoft Copilot, необходимо интегрировать аутентификацию. Дополнительные сведения см. в разделе Настройка проверки подлинности пользователей в Copilot Studio. Для отдельных узлов генеративных ответов см. Аутентификация.

Кроме того, может потребоваться учесть особенности URL-адресов , которые требуют дополнительной проверки подлинности для источников.

Поиск по базе знаний в классическом и генеративном режимах

То, как система осуществляет поиск по источникам знаний, зависит от того, какой режим оркестрации использует агент: классический или генеративный.

Классическая оркестрация

При настройке агента для использования классической оркестрации применяются следующие условия.

  • В системной теме Оптимизация разговора количество источников знаний, в которых агент может выполнять поиск, ограничено. Это зависит от типа источника знаний. Ваш агент может выполнять поиск в любой комбинации источников знаний, вплоть до максимального количества, указанного для каждого типа в следующей таблице:

    Тип источника знаний Ограничение
    Подключение службы Azure OpenAI 5
    Идентификаторы пользовательской настройки пользовательского поиска Bing 2
    Пользовательские источники данных 3
    Источники знаний Dataverse 2 источника, каждый из которых может содержать до 15 таблиц
    URL-адреса SharePoint 4
    Отправленные файлы Unlimited
    URL-адреса веб-сайта 4
  • Кроме того, в тему можно внедрить узел генеративных ответов, чтобы поиск выполнялся по конкретным намерениям, а не только в качестве резервного варианта. Применяются ограничения на источники знаний, указанные выше.

  • Классическая оркестрация поддерживает пользовательские источники данных в дополнение к другим источникам знаний.

Генеративная оркестрация

При настройке агента для использования генеративной оркестрации применяются следующие условия:

Параметры источников знаний агента

Страница параметров вашего агента на базе генеративного ИИ содержит важные настройки, влияющие на то, как агент использует источники знаний.

Разрешить ответы без граундинга

Настройка Разрешить ответы без граундинга в разделе Знания в настройках генеративного ИИ вашего агента управляет тем, может ли агент генерировать ответы, используя только общие знания модели. Для использования этой настройки у агента должен быть включен режим генеративной оркестрации.

Снимок экрана настройки «Разрешить ответы без граундинга» в разделе «Знания».

Когда вы включаете параметр Разрешить ответы без граундинга, ваш агент может ответить, используя общие знания модели, даже если он не использует источники знаний или инструменты.

Когда вы отключаете эту настройку, агент блокирует любой ответ, сгенерированный в ходе диалога, если он не использовал источник знаний или инструмент. Это условие означает, что ответ блокируется, если агент отвечает на вопрос, используя историю диалога или общие знания, без обращения к источнику знаний или инструменту. В таком случае срабатывает резервная тема.

Например, рассмотрим следующий разговор:

Пользователь: «Какова политика возврата онлайн-заказов?»

Агент: «Наша политика возврата позволяет возвращать товары в течение 30 дней с момента покупки (для всех товаров, включая товары со скидкой)». (Получено из источника знаний)

Пользователь: «Это распространяется и на товары со скидкой?»

Агент:(заблокировано)

В этом сценарии агент может решить, что у него уже достаточно контекста из предыдущих сообщений, чтобы ответить на дополнительный вопрос, не обращаясь к другому инструменту или источнику знаний, поэтому ответ блокируется.

Note

Отключение настройки Разрешить ответы без граудинга не гарантирует, что агент никогда не использует общие знания. Базовая модель агента все еще может включать общие знания, когда объединяет их с информацией, полученной из источников знаний или инструментов. Эта настройка блокирует только те ответы, когда агент вообще не использовал никакой источник знаний или инструмент в этот ход.

Почему агент иногда не дает обоснованный ответ

Когда вы отключаете параметр Разрешить необоснованные ответы, агент возвращает ответ из источника знаний только тогда, когда в ответе есть цитата из текста в этом источнике. Это требование помогает убедиться, что ответы основаны на ваших источниках знаний, а не на общих знаниях модели.

Иногда модель генерирует правильный ответ из источника знаний, но не содержит цитаты из него. Когда это происходит, агент скрывает ответ и отвечает так, будто не нашел никакой информации. Поскольку модели не всегда включают цитаты, такое поведение может быть непостоянным. Например, на повторно заданный тот же вопрос может быть возвращен ответ.

Чтобы сделать цитаты и обоснованные ответы более последовательными:

  • Добавьте инструкции по цитированию. В инструкциях агента попросите модель всегда цитировать свои источники. Например, «Всегда включайте цитату из текста исходного документа для каждого утверждения».
  • Избегайте инструкций, мешающих цитированию. Инструкции, которые указывают модели опускать ссылки или источники, либо заставляют использовать жесткий формат вывода (например, «отвечать только в JSON»), могут подавлять нужные агенту маркеры цитирования. Поддерживайте инструкции лаконичными и не заставляйте модель удалять или переформатировать источники так, чтобы это их нарушало.
  • Добавьте сведения о цитировании в пользовательские данные. Если вы используете пользовательский источник данных в узле генеративных ответов, добавьте поля ContentLocation (URL-адрес) и Title, чтобы модель могла процитировать источник. Подробнее см. в статье Использование пользовательского источника данных для узлов генеративных ответов.

Note

Если хотите, чтобы агент отвечал, даже если не может процитировать источник, включите Разрешить необоснованные ответы. После этого агент может ответить, используя общие знания модели, поэтому его ответы не всегда основаны на ваших источниках знаний.

Как цитаты выглядят на разных каналах

Способ отображения цитат может различаться в зависимости от канала:

  • Microsoft Teams имеет более строгие ограничения, чем у других каналов. В ответе отображается не более 20 цитат; все сверх этого отбрасывается. Название каждой цитаты ограничено примерно 80 символами, а ее фрагмент — примерно 480 символами, поэтому более длинные заголовки или фрагменты сокращаются.
  • Если вы настроите генеративный ответ, цитаты не добавляются автоматически. Например, если вы очищаете узел Сообщение и отображается ответ самостоятельно через переменную или адаптивную карточку, вам нужно включить отображение цитат самостоятельно. В Teams ссылки цитат возвращаются автоматически только для ответов, которые не были настроены. Подробнее см. в разделе Цитаты не отображаются для настроенных ответов.

Использование информации из Интернета

Вы можете найти настройку Использовать информацию из Интернета на странице настроек генеративного ИИ агента. Вы также можете найти настройку Веб-поиск в разделе Знания на странице Обзор агента. Эта настройка позволяет вашему агенту получать обширную, оперативную и обновленную информацию, выходящую за рамки заранее определенных или корпоративных баз знаний. Для использования этой настройки у агента должен быть включен режим генеративной оркестрации.

Когда вы включаете настройку Использовать информацию из Интернета/Поиск в Интернете, он срабатывает, когда информация из Интернета может быть полезна для ответа на вопрос пользователя. Он осуществляет поиск среди всех публичных сайтов, индексируемых Bing. Этот тип поиска осуществляется параллельно с поисками по публичным сайтам, которые вы добавили в качестве источников знаний. Результаты из Использовать информацию из Интернета/Поиск в Интернета перемежаются с результатами из настроенных источников знаний на вашем публичном сайте.

Note

Использовать информацию из Интернета/Поиск в Интернете использует Граундинг с Поиском Bing для возврата информации из Интернета.

Модерация

Когда вы включаете настройки модерации контента, ваш агент может давать больше ответов. Однако увеличение числа ответов может повлиять на допустимое попадание вредоносного контента от агента.

Вы можете настроить параметры модерации контента в следующих областях:

  • Параметр на странице параметров Генеративный ИИ задает модерацию на уровне агента.
  • Параметр в узле генеративных ответов задает модерацию на уровне темы.
  • Параметр в инструменте запросов устанавливает модерацию на уровне запроса.

Во время выполнения приоритет имеет параметр на уровне темы. Если вы не установите модерацию контента на уровне темы, по умолчанию будет использоваться конфигурация генеративного ИИ.

Чтобы переопределить модерацию контента агента или темы для инструментов запроса, настройте параметр Завершение инструмента запроса так, чтобы отправлять определенный ответ.

Чтобы изменить настройки модерации контента на уровне агента, измените параметр агента Генеративный ИИ на Генеративный.

  1. Выберите желаемый уровень модерации для агента.

    Уровни модерации варьируются от самой низкой до самой высокой. Самый низкий уровень генерирует больше всего ответов, но они могут содержать вредоносный контент. Самый высокий уровень модерации контента генерирует меньше ответов и применяет более строгий фильтр для ограничения вредоносного контента. Уровень модерации по умолчанию — Высокий.

  2. Нажмите Сохранить.

Чтобы настроить параметры модерации контента на уровне темы, измените их в узле генеративных ответов.

Чтобы настроить параметры модерации контента для инструмента запросов, измените этот параметр в конструкторе запросов.

Настройка Граундинг Graph в клиенте с использованием семантического поиска на странице настроек Генеративный ИИ вашего агента определяет, использует ли агент семантический поиск для улучшения результатов поиска. Для использования этой настройки у агента должен быть включен режим генеративной оркестрации.

По умолчанию все пользователи с лицензиями Microsoft 365 Copilot используют граундинг Graph в клиенте с использованием семантического поиска. Однако, если не у всех конечных пользователей есть лицензии Microsoft 365 Copilot, включите эту настройку, чтобы использовать для таких пользователей семантический индекс для улучшения качества. Эта функция предоставляется за дополнительную плату. Подробнее см. в статье Ставки выставления счетов по кредитам Copilot.

Для использования этой функции агент должен находиться в одном арендаторе с лицензией Microsoft 365 Copilot. Также необходимо настроить семантический индекс. Для использования семантического индекса лицензия Microsoft 365 Copilot должна быть назначена минимум одному пользователю в организации.

Important

Функция Граундинг Graph в клиенте с использованием семантического поиска требует, чтобы для аутентификации пользователя в агенте был установлен режим Проверка подлинности через Microsoft. Если аутентификация установлена на любой другой метод, кроме Проверка подлинности через Microsoft, вы не сможете изменить настройку.

Когда вы включаете эту функцию и у создателя есть лицензия Microsoft 365 в том же клиенте, агент поддерживает SharePoint и соединители, содержащие файлы размером до 200 МБ.

Note

  • Для агентов, основанных на источниках знаний SharePoint, Граундинг Graph в клиенте с использованием семантического поиска обеспечивает значительно более эффективное получение знаний и высокое качество ответов. Эта функция использует передовые внутренние инструменты поиска, которые позволяют агенту получать больший объем контекста с большей точностью. Однако из-за усложнения системы отдельные пользователи и запросы могут столкнуться с небольшой задержкой.

  • Если у вас нет лицензии Microsoft 365 Copilot в том же арендаторе, что и ваш агент, или качество ответов снизилось, отключите эту функцию.

  • Создателю агента не требуется лицензия Microsoft 365 Copilot для создания агента с семантическим индексом.

  • Соединители SharePoint и Microsoft Copilot поддерживают файлы размером до 512 МБ, если они имеют расширения PDF, PPTX или DOCX. Узнайте больше о поддерживаемых типах файлов в разделе Поддерживаемые типы контента.

  • Функция Граундинг Graph в клиенте с использованием семантического поиска — это отдельная функция, отличная от функции Поиск Dataverse. Дополнительные сведения о том, как работает поиск Dataverse, см. в разделе Вопросы и ответы о поиске Dataverse.

Настройки источников знаний на странице обзора агента

Следующие параметры на странице Обзор агента влияют на то, как агент использует источники знаний.

Настройка Поиск в Интернете в разделе Знания на странице Обзор агента. Настройка Использование информации из Интернета на странице настроек Генеративный ИИ также управляет этой настройкой. Когда вы включаете эту настройку, она срабатывает, когда для ответа на вопрос пользователя может быть полезна информация из Интернета. Он осуществляет поиск среди всех публичных сайтов, индексируемых Bing. Этот тип поиска осуществляется параллельно с поисками по публичным сайтам, которые вы добавили в качестве источников знаний. Результаты из функции Поиск в Интернета перемежаются с результатами из настроенных источников знаний на вашем публичном сайте.

Снимок экрана страницы обзора агента, с акцентом на раздел

Официальные источники

После добавления источников знаний в агент вы не всегда можете контролировать, как со временем изменяется информация, или не всегда полностью доверяете этой информации. Важно дать пользователям понять, что они должны с осторожностью относиться к ответам и проверять их, когда это необходимо.

Однако вы можете понимать, что определенный источник знаний проходит строгую проверку и пользуется большим доверием. В таком случае вы можете пометить его как официальный источник. Агент может использовать его напрямую, без проверки.

Чтобы отметить источник знаний как официальный, на странице Знания нажмите на три точки () для источника знаний, выберите Официальный источник, затем выберите Да.

Note

  • Эта функция пока несовместима с включенной функцией генеративной оркестрации. Если вы хотите, чтобы агент использовал официальные источники знаний и помечал их как таковые, отключите генеративную оркестрацию.
  • Когда агент использует авторитетные источники знаний, ответ начинается с отличительного признака.

Добавление знаний для генеративных ответов

Генеративные ответы позволяют вашему агенту находить и представлять информацию из нескольких источников, внутренних или внешних, без необходимости создавать конкретные темы. Используйте генеративные ответы в качестве основного источника информации или в качестве резервного источника, если созданные темы не могут ответить на запрос пользователя. В результате можно быстро создать и развернуть функциональный агент. Создателям не нужно вручную создавать несколько тем, которые могут не отвечать на все вопросы клиентов.

По умолчанию при создании агента Copilot Studio автоматически создает системную тему Оптимизация разговора. Эта тема содержит узел генеративных ответов, который можно использовать для немедленного начала использования источников знаний. Все источники знаний, добавляемые на уровне агента, добавляются в узел генеративных ответов в системной теме Оптимизация разговора.

Предварительные условия и информацию об ограничениях см. в разделе Генеративные ответы.

Подробнее об аналитических метриках по каждому источнику знаний см.: