Примечание.
Для доступа к этой странице требуется авторизация. Вы можете попробовать войти или изменить каталоги.
Для доступа к этой странице требуется авторизация. Вы можете попробовать изменить каталоги.
Важно
Предварительные версии API 2024-12-01-preview и 2025-05-01-preview будут прекращены 15 июля 2026 г. Если вы по-прежнему используете API предварительной версии, обновите код, чтобы выбрать последнюю версию 2025-11-01 (GA)API.
Версии 2024-12-01-preview API и 2025-05-01-preview доступны в общедоступной предварительной версии. Эти предварительные версии предоставляются без соглашения об уровне обслуживания и не рекомендуются для производственных нагрузок. Дополнительные сведения см. в разделе Supplemental Terms of Use for Microsoft Azure Previews и Microsoft Products and Services Data Protection Addendum (DPA).
Azure Распознавание содержимого в средстве Foundry — это служба создания искусственного интеллекта, предназначенная для получения структурированной аналитики из многомодального содержимого, например документов, изображений, видео и аудио. При внедрении 2025-05-01-preview версии служба предлагает два режима: standard и pro.
Стандартный: этот режим используется по умолчанию для обработки различных типов контента. Она оптимизирована для обеспечения эффективного извлечения схем, адаптированного к конкретным задачам в форматах данных. В этом режиме подчеркивается эффективность затрат и снижение задержки.
Pro: этот режим предназначен для расширенных вариантов использования, требующих многошагового рассуждения и сложного принятия решений (например, выявления несоответствий, делание выводов и принятия решений). Режим pro поддерживает несколько входных документов и позволяет предоставлять справочные данные во время создания анализатора. В настоящее время профессиональный режим доступен только для данных документа.
Общие сведения о стандартном режиме
Стандартный режим "Понимание содержимого" предоставляет структурированные аналитические сведения по различным типам данных, включая документы, видео, изображения, звук и текст. Хотя он не поддерживает вывод данных, он сводит к минимуму затраты и задержки, что делает его идеальным для широких, ориентированных на данные сценариев. Этот режим позволяет создавать или настраивать схемы для извлечения точных аналитических сведений, адаптированных к вашим потребностям. Кроме того, он включает разметку данных для документов, позволяя человеческому вмешательству повысить качество ваших выходных данных.
Стандартный режим: вариант использования
Стандартный режим идеально подходит для извлечения точных аналитических сведений, необходимых для любого типа данных. Если необходимо разблокировать содержимое данных, ваш сценарий может не требовать сложного анализа или принятия решений. Сценарии, для которых стандартный режим подходит лучше всего, включают:
- Структурирование данных для обеспечения работы рабочих процессов поиска RAG и интеграции с AI Search.
- Извлечение данных для интеграции с Microsoft Fabric.
- Анализ рекламных видео для проверки на соответствие стандартам контента.
- Сегментирование видеоматериалов для создания глав и выявления идеальных рекламных разрывов.
- Извлечение ключевых данных из спортивных игр и предоставление послеигровых обзоров.
Обзор режима Pro
"Режим Pro для распознавания содержимого предназначен для клиентов со сложными случаями использования, предлагая многошаговые возможности рассуждения и поддержку документов с несколькими входными данными." Он позволяет анализировать как входное содержимое, так и справочные данные, что делает его идеальным для сценариев, требующих сложного анализа. Включив эталонные данные, профессиональный режим добавляет контекст к каждому запросу, помогая таким задачам, как проверка и обогащение. В настоящее время профессиональный режим доступен исключительно для данных документа.
Справочные данные в режиме Pro
Во время создания анализатора можно указать справочные документы, добавляющие контекст во время анализа. Например, чтобы проанализировать счета для согласованности с договорным соглашением, можно указать счет и связанные документы (например, заказ на покупку) в качестве входных данных и предоставить файлы контракта в качестве эталонных данных. Служба использует логику для проверки входных документов согласно вашей схеме, например, выявления несоответствий для дальнейшей проверки. Если документы находятся в пределах ограничений входных документов в режиме pro, попробуйте предоставить все связанные документы в качестве входных данных, если возникают проблемы с качеством.
Многошаговое рассуждение
Многоступенчатое рассуждение разлагает сложные проблемы на более простые задачи. Он принимает анализ данных за рамки извлечения и агрегирования структурированных данных и позволяет делать выводы по этим данным, минимизируя потребность в анализе человека. Примеры вопросов, на которые режим pro может ответить включают:
- Соответствует ли x y?
- Соответствует ли x указанным критериям?
- Соответствует ли документ x требуемым рекомендациям?
- Равна ли сумма сумме элементов?
- Найдите все несоответствия между счетом и контрактом.
Особенности стандартного и профессионального режима
Не знаете, какой режим подходит для вашего сценария? На следующих диаграммах сравниваются стандартные и профессиональные функции режима.
| Функция | Стандартный режим | Профессиональный режим |
|---|---|---|
| Большие документы | ✓ | ✓ |
| Режим поля | ✓ | ✓ |
| Извлечение, классификация и создание полей | ✓ | ✓ |
| Оценки заземления и достоверности | ✓ | ✗ |
| Тип входного документа | Документы, изображения, видео, звук | Документы |
| Максимальное число полей | 100 | 100 |
| Обработка нескольких входных документов | ✗ | ✓ |
| Интеграция с эталонным набором данных | ✗ | ✓ |
| Многошаговое рассуждение | ✗ | ✓ |
Применение стандартного или pro режима к сценариям
К многим сценариям можно применять стандартные и профессиональные режимы распознавания контента. Как вы создаете решение, зависит от вопросов, которые вы стремитесь ответить. В следующих сценариях приведены примеры.
| Сценарий | Стандартный режим | Профессиональный режим |
|---|---|---|
| Анализ счетов | Извлеките инсайты из данных по счетам в масштабируемом объеме и обеспечьте возможность поиска RAG, а также дальнейшего анализа и визуализации данных. Ответы на такие вопросы: • Извлеките номер заказа на покупку, общую сумму, срок погашения и позиции для занесения в базу данных. |
Анализ счетов и договорных соглашений с клиентами и применение многошагового мышления для получения выводов на основе этих данных. Ответы на такие вопросы: • Выполняет ли этот счет договорное соглашение, которое у нас есть с этим клиентом? • Требуется ли этот счет дальнейшего рассмотрения? |
| Аналитика расшифровки в центре обработки вызовов | Извлеките аналитические данные из больших объемов информации центра обработки вызовов, чтобы получить ценные инсайты о тональности, понять проблемы клиента и создать целевую подготовку для решения основных проблем. Ответы на такие вопросы: • Каковы основные проблемы, о которых звонят клиенты? • Какова средняя длина звонков, сделанных о проблеме x? |
Анализ данных расшифровок звонков центра и применение многоступенчатого рассуждения, чтобы понять, как сотрудники центра обработки вызовов обращаются к потребностям клиентов, и следуют ли они рекомендациям. Ответы на такие вопросы: • Представился ли сотрудник центра обработки вызовов? • Этот ответ соответствовал определённым условиям? |
| Обработка ипотечных приложений | Извлеките ключевые значения из данных приложения ипотеки и сделайте его доступным для поиска и более удобным. Ответы на такие вопросы: • В каком году была подана заявка на ипотеку? Какие имена указаны в приложении? |
Анализируйте дополнительную сопроводительную документацию и ипотечные заявки, чтобы определить, предоставляет ли потенциальный покупатель жилья всю необходимую документацию для получения ипотеки. Ответы на такие вопросы: • Соответствуют ли имена и социальные номера в заявке на ипотеку вспомогательной документации? |
Попробуйте режим Pro
Вы можете попробовать функции стандартных и профессиональных режимов распознавания содержимого с помощью Microsoft Foundry. Служба позволяет использовать собственные данные и экспериментировать со всеми функциями обоих режимов в упрощенном подходе без кода, чтобы помочь вам найти оптимальный вариант для уникального сценария.
Известные ограничения и рекомендации по режиму Pro
В настоящее время режим "Понимание содержимого" не предоставляет уровни уверенности или обоснования. Он поддерживает
classifyиgenerateполя, но не поддерживаетextractполя.Режим "Распознавание содержимого" в настоящее время доступен только для документов.
Система работает в режиме поиска при ссылке на документы. Если требуется исчерпывающее восстановление данных, включите содержимое в входной набор.
Схемы должны быть разработаны с максимальным уровнем специфики. Например, вместо представления обобщенного списка несоответствий рекомендуется создавать отдельные поля для каждого типа несоответствия, а также подробные описания. Кроме того, при необходимости следует включить ссылки на конкретные разделы соответствующих документов, которые должны быть рассмотрены.
Справочные документы должны быть краткими и сосредоточенными. Определите приоритет важных документов и убедитесь, что они максимально кратки для повышения срока хранения и отзыва.
Дальнейшие действия
Дополнительные сведения об обработке документов см. в обзоре обработки документов.