Модели Claude в Microsoft Foundry

Модели Claude компании Anthropic привносят в Microsoft Foundry передовые возможности диалогового ИИ, обеспечивая современное понимание и генерацию языка для интеллектуальных приложений. Модели Claude превосходно справляются с сложными рассуждениями, генерацией кода и многомодальными задачами, включая задачи анализа изображений. В этой статье описываются доступные модели Claude, их размещение и выставление счетов, поддерживаемые API, возможности и рекомендации.

Сведения о развертывании и вызове модели Claude см. в статье "Развертывание и использование моделей Claude" в Microsoft Foundry.

Important

Элементы, помеченные (предварительная версия) в этой статье, в настоящее время находятся в общедоступной предварительной версии. Эта предварительная версия предоставляется без соглашения об уровне обслуживания, и мы не рекомендуем ее для рабочих нагрузок. Некоторые функции могут не поддерживаться или их возможности могут быть ограничены. Для получения дополнительной информации см. Дополнительные условия использования для предварительных версий Microsoft Azure.

Как размещаются модели Claude и как осуществляется их тарификация

Microsoft Foundry предлагает модели Claude в двух версиях:

  • Версия 1. Размещенная в инфраструктуре Anthropic; эти модели выполняются в инфраструктуре Anthropic (за пределами Azure).
  • Версия 2. Размещенная на Azure; эти модели выполняются на сквозной инфраструктуре Azure и являются общедоступными.

Не все модели доступны в обеих версиях. Этап жизненного цикла модели, например предварительная версия или общедоступная версия, может отличаться от двух версий. Сведения о доступности и жизненном цикле для каждой модели см. в разделе "Доступные модели Claude".

Чтобы сравнить оба варианта размещения по таким аспектам, как размещение данных, соглашения об уровне обслуживания (SLA), каналы поддержки, соответствие требованиям и процесс покупки, см. статью Сравнение моделей Claude, размещенных в Azure и Anthropic.

Note

В Microsoft Foundry вы получаете доступ к моделям Claude через модели Foundry от партнеров и сообщества. Модели партнеров и сообщества, которые Anthropic продает и эксплуатирует, согласно Условиям использования продуктов являются продуктами, не относящимися к Microsoft.

Моделям Claude в Foundry требуется подписка Azure Marketplace, а их тарификация осуществляется в единицах потребления Claude (CCU). Перед развертыванием убедитесь, что у вас есть разрешения, необходимые для подписки на предложения модели . Сведения о ценах см. в статье Тарификация единиц потребления Claude (CCU) в Microsoft Foundry.

Доступные модели Claude

Important

Следующие модели Claude соответствуют стандарту ЕС по нанесению водяных знаков: claude-mythos-5-1, claude-fable-5-1 и claude-fable-5. В то время как claude-fable-5 использует встраивание водяных знаков с одним ключом, claude-mythos-5-1 и claude-fable-5-1 используют двухключевую схему (переплетённый двухключевой метод и C2PA) следующим образом:

  • Переплетённые текстовые водяные знаки (второй ключ): для обнаружения переплетённых водяных знаков в соответствии со стандартами ЕС добавляется второй ключ. Нанесение водяных знаков происходит на стороне сервера в момент генерации; формат запросов и ответов не меняется. Отдельный API для обнаружения водяных знаков доступен в рамках раннего доступа и не входит в первоначальный объем запуска Foundry.
  • Нанесение водяных знаков C2PA: маркировка происхождения контента C2PA, выполняемая на стороне сервера или клиента в интерфейсах Anthropic. Структура API не изменилась.

В следующей таблице сравнивается доступность обеих версий моделей Claude в Foundry. Дополнительные сведения о функциях, указанных в таблице, см. в разделе " Возможности" и "Дополнительные возможности ".

Ошибки при развертывании или вызове моделей Claude см. в статье "Развертывание и использование моделей Claude: устранение неполадок".

Модель Availability Окно контекста / Максимальное значение выходных данных Ключевые возможности лучше всего подходит для
claude-fable-5-1
  • Размещено на инфраструктуре Anthropic: Предварительная версия
1M / 128K
  • Адаптивное мышление
  • Длительные трудоемкие работы
  • Научное исследование с самопроверкой
  • Интеллектуальная работа; выполнение сложной интеллектуальной работы при меньшем непосредственном контроле
  • Отказ stop_reason от политик защиты двойного использования1
  • См. Что нового в Claude Fable 5.1 и Claude Mythos 5.1
  • Долго работающие агенты
  • Программирование и агенты с расширенными возможностями рассуждения для корпоративных рабочих процессов
  • Общая наука и исследования
  • Финансовый анализ
  • Видение
claude-fable-5
  • Размещено на инфраструктуре Anthropic: Предварительная версия
1M / 128K
  • Адаптивное мышление
  • Анализ всей базы кода и контекста многодневного проекта
  • Более длительная автономная работа, чем у любой предыдущей модели Claude
  • Самостоятельная проверка
  • Оркестрация субагентов
  • Отказ stop_reason от политик защиты двойного использования1
  • См. Переход на Claude Fable 5.1 и Claude Mythos 5.1
  • Cybersecurity
  • Автономное кодирование
  • Долго работающие агенты
  • Программирование и агенты с расширенными возможностями рассуждения для корпоративных рабочих процессов
claude-mythos-5-1 2
  • Размещено на инфраструктуре Anthropic: исследовательская предварительная версия с ограниченным доступом
1M / 128K
  • Биология и науки о жизни
  • Кибербезопасность (приоритетные варианты оборонного использования): обнаружение уязвимостей, аудит на поверхности атак, красная команда, аналитика угроз
  • Автономное кодирование
  • Долго работающие агенты
claude-mythos-5 2
  • Размещено на инфраструктуре Anthropic: исследовательская предварительная версия с ограниченным доступом
1M / 128K
  • Биология и науки о жизни
  • Кибербезопасность (приоритетные варианты оборонного использования): обнаружение уязвимостей, аудит на поверхности атак, красная команда, аналитика угроз
  • Автономное кодирование
  • Долго работающие агенты
claude-mythos-preview 2
  • Размещено на инфраструктуре Anthropic: исследовательская предварительная версия с ограниченным доступом
1M / 128K
  • Кибербезопасность (приоритеты для оборонительных вариантов использования)
  • Автономное кодирование
  • Долго работающие агенты
claude-opus-5
  • Размещено в Azure: ga
  • Размещено в инфраструктуре Anthropic: общедоступная версия
1M / 128K
  • Адаптивное мышление с xhigh и max уровнями усилий
  • Анализ всей базы кода и контекста многодневного проекта
  • Элементы управления усилием для каждого хода3
  • Во время беседы3role:"system"
  • Бюджеты токенов3 (task_budget)
  • См. Что нового в Claude Opus 5
  • Интеллект уровня Near-Fable для долгосрочных задач программирования и сложной агентной оркестрации.
  • Долго работающие агенты
  • Корпоративные рабочие процессы
  • Финансовый анализ
  • Использование компьютера
claude-opus-4-8
  • Размещено в Azure: ga
  • Размещено в инфраструктуре Anthropic: общедоступная версия
1M / 128K
  • Адаптивное мышление с xhigh уровнем усилий
  • Анализ всей базы кода и контекста многодневного проекта
  • Входное изображение высокого разрешения (до 2576 пикс. / 3,75 Мп)
  • См. Переход на Claude Opus 5
  • Coding
  • Долго работающие агенты
  • Финансовый анализ
  • Cybersecurity
  • Использование компьютера
claude-opus-4-7
  • Размещено в инфраструктуре Anthropic: общедоступная версия
1M / 128K
  • Адаптивное мышление
  • Обоснование всей базы кода
  • Входное изображение высокого разрешения (до 2576 пикс. / 3,75 Мп)
  • См. Переход на Claude Opus 5
  • Coding
  • Корпоративные рабочие процессы
  • Долго работающие агенты
  • Многомодальное обоснование
  • Финансовый анализ
  • Cybersecurity
claude-opus-4-6
  • Размещено в инфраструктуре Anthropic: общедоступная версия
1M / 128K
  • Адаптивное мышление
  • Ввод изображения и текста
  • Использование компьютера
  • Расширенное использование средства (поиск, программный вызов, примеры)
  • См. Переход на Claude Opus 5
  • Coding
  • Корпоративные агенты
claude-opus-4-5
  • Размещено в инфраструктуре Anthropic: общедоступная версия
200K / 64K
  • Расширенное мышление
  • Ввод изображения и текста
  • Использование компьютера
  • Расширенное использование средства (поиск, программный вызов, примеры)
  • См. Переход на Claude Opus 5
  • Coding
  • Агенты
  • Использование компьютера
  • Корпоративные рабочие процессы
claude-sonnet-5
  • Размещено в Azure: ga
  • Размещено в инфраструктуре Anthropic: общедоступная версия
1M / 128K
  • Адаптивное мышление
  • xhigh уровень усилий
  • Анализ всей базы кода и контекста многодневного проекта
  • Ввод изображений в высоком разрешении (до 2576 пикселей / 3,75 МП) включён по умолчанию
  • Во время беседы3role:"system"
  • Бюджеты токенов3 (task_budget)
  • Смотрите Что нового в Claude Sonnet 5
  • Coding
  • Долго работающие агенты
  • Финансовый анализ
  • Cybersecurity
  • Использование компьютера
claude-sonnet-4-6
  • Размещено в инфраструктуре Anthropic: общедоступная версия
1M / 128K
  • Адаптивное мышление
  • Ввод изображения и текста
  • Использование компьютера
  • Расширенное использование средства (поиск, программный вызов, примеры)
  • См. Переход на Claude Sonnet 5
  • Coding
  • Агенты
  • Корпоративные рабочие процессы
claude-sonnet-4-5
  • Размещено в инфраструктуре Anthropic: общедоступная версия
200K / 64K
  • Расширенное мышление
  • Ввод изображения и текста
  • Использование компьютера
  • См. Переход на Claude Sonnet 5
  • Агенты и сложные задачи с длительным горизонтом планирования
  • Высокообъёмные рабочие нагрузки
claude-haiku-4-5
  • Размещено в Azure: ga
  • Размещено в инфраструктуре Anthropic: общедоступная версия
200K / 64K
  • Расширенное мышление
  • Ввод изображения и текста
  • Coding
  • Агенты

1Claude Fable 5 и Claude Fable5.1 применяют дополнительные классификаторы входных и выходных данных, которые могут отказаться от запросов, если содержимое активирует политики защиты двойного использования. При отказе запрос возвращает успешный ответ (200) с индикатором stop_reason: "refusal" отказа вместо содержимого, созданного моделью. С вас не взимается плата за отклонённые входные токены.

2Claude Mythos 5-1, Claude Mythos 5 и Claude Mythos Preview доступны только в рамках исследовательского предварительного доступа с ограниченным доступом. Доступ к моделям предоставляется исключительно по усмотрению Anthropic, при этом приоритет отдаётся защитным сценариям использования в области кибербезопасности. См. карточку системы Claude Fable 5.1 и Claude Mythos 5.1, карточку системы Claude Mythos 5 и карточку системы Claude Mythos Preview с рекомендациями по ответственному использованию.

3 элемента управления усилием на каждом ходе, функция продолжения в середине разговора и бюджеты токенов в настоящее время находятся в бета-версии.

Обзор API

В следующей таблице перечислены API, которые можно использовать для взаимодействия с версиями моделей Claude в Foundry, размещенными на Azure и размещенными в инфраструктуре Anthropic.

Используйте Anthropic SDK и следующие API Claude:

Tip

Версия моделей Claude в Foundry, размещённая на инфраструктуре Anthropic, поддерживает больше API, чем указано в этой таблице. Вы можете увидеть их на странице документации Claude API: обзор API.

API Description
Сообщения1 (POST /v1/messages) Основной Messages API: отправляйте структурированный список входных сообщений с текстовым или графическим содержимым, включая потоковую передачу ответов. Модель создает следующее сообщение в беседе.
Подсчёт токенов (POST /v1/messages/count_tokens) API счетчика маркеров: подсчитывайте количество маркеров в сообщении перед отправкой в Claude.

1Api сообщений можно вызвать из anthropic пакета Python, @anthropic-ai/foundry-sdk пакета JavaScript или напрямую через REST. Конечная точка развертывания имеет вид https://<resource-name>.services.ai.azure.com/anthropic/v1/messages, а клиенты REST и JavaScript используют заголовок anthropic-version: 2023-06-01.

Возможности и расширенные функции

Модели Claude в Foundry предоставляют основные возможности для обработки, анализа и создания содержимого, а также средств , которые позволяют Claude взаимодействовать с внешними системами, выполнять код и выполнять автоматизированные задачи. Поверхность API Клода организована в пять областей:

В следующих разделах и таблицах приведен обзор возможностей, доступных в версиях моделей Claude в Foundry, размещаемых в Azure и размещаемых в инфраструктуре Anthropic. Если не указано, возможность применяется к обеим версиям.

Tip

Версия, размещённая в инфраструктуре Anthropic, моделей Claude в Foundry поддерживает больше функций, чем указано в этих таблицах. Полный список возможностей можно просмотреть в документации по платформе Claude: общие сведения о функциях.

Дополнительные сведения о доступных возможностях и расширенных функциях для моделей Claude в Foundry см. в блоге разработчика Microsoft.

Возможности модели

Способы управления Claude и его непосредственными ответами, включая формат ответа, глубину рассуждений и типы входных данных.

Функция Description
Потоковая передача сообщений При создании сообщения задайте "stream": true, чтобы передавать ответ потоково по мере его формирования с помощью событий, отправляемых сервером (SSE).
Размышление Улучшенные способности к рассуждению для решения сложных задач, обеспечивающие прозрачность пошагового хода рассуждений Claude перед тем, как дать окончательный ответ. См. «Мышление и усилия»: значения параметров thinking для каждой модели.
Адаптивное мышление Пусть Клод динамически решает, когда и сколько думать. Эта функция является единственным режимом мышления для моделей Claude 4.7 и более поздних версий. effort Используйте параметр для управления глубиной мышления.
Effort Управляйте количеством токенов, которые Claude использует в ответе, находя баланс между полнотой ответа и экономией токенов. См. «Мышление и усилия»: значения параметров effort для каждой модели.
Цитаты Основывайте ответы Клода на источниках, включая блоки содержимого search_result.
Изображения и видение Обработка и анализ содержимого из изображений. Развертывания, размещенные в Azure, принимают только изображения в кодировке Base64 или изображения по URL.
Поддержка PDF Обработка и анализ текста и визуального содержимого из pdf-документов. Предоставьте PDF-файлы в виде base64 или URL-адреса.
Окно контекста 1M До 1 миллиона токенов для обработки больших документов, крупных кодовых баз и длинных диалогов. Поддержка зависит от соответствия модели требованиям.
Структурированные выходные данные Ограничьте ответы Claude так, чтобы они соответствовали определённой JSON-схеме, используя две взаимодополняющие возможности: JSON-вывод (параметр output_config.format) для структурированных ответов и строгое использование инструментов (strict: true) для валидированных входных данных инструментов. Для развертываний, размещенных в Azure, структурированные выходные данные также поддерживают устаревший параметр выходных данных JSON (output_formatпараметр).

Мышление и усилия

Функция «Thinking» допускает определённые значения для параметра типа thinking в зависимости от модели, как описано в следующей таблице. Тип adaptive настраивает функцию адаптивного мышления , позволяя модели решать, следует ли думать на основе сложности запросов и уровня усилий. Например: thinking={"type": "adaptive"}.

Модель adaptive enabled disabled
claude-fable-5-1 Yes Нет Нет
claude-fable-5 Yes Нет Нет
claude-mythos-5-1 Yes Нет Нет
claude-mythos-5 Yes Нет Нет
claude-mythos-preview Yes Yes Нет
claude-opus-5 Yes Нет Да1
claude-opus-4-8 Yes Нет Yes
claude-opus-4-7 Yes Нет Yes
claude-opus-4-6 Yes Yes Yes
claude-sonnet-5 Yes Нет Yes
claude-sonnet-4-6 Yes Yes Yes

1 Мышление может быть disabled только при уровне усилий high или ниже

Функция "Усилия" позволяет использовать определенные effort уровни для каждой модели, как описано в следующей таблице. Уровень xhigh дает тот же результат, что и max.

Модель low medium high xhigh max
claude-fable-5-1 Yes Yes Yes Yes Нет
claude-fable-5 Yes Yes Yes Yes Нет
claude-mythos-5-1 Yes Yes Yes Yes Нет
claude-mythos-5 Yes Yes Yes Yes Нет
claude-opus-5 Yes Yes Yes Yes Yes
claude-opus-4-8 Yes Yes Yes Yes Yes
claude-opus-4-7 Yes Yes Yes Yes Yes
claude-opus-4-6 Yes Yes Yes Нет Yes
claude-sonnet-5 Yes Yes Yes Yes Yes
claude-sonnet-4-6 Yes Yes Yes Нет Yes

Tools

Позвольте Claude выполнять действия в Интернете или в вашей среде. Эта функция включает встроенные инструменты, которые Claude вызывает через tool_use. Платформа запускает серверные инструменты, а вы реализуете и выполняете клиентские инструменты.

Функция Description
Использование инструментов, выполняемых на стороне клиента Пользовательские инструменты плюс определённые Anthropic bash, text editor, computer use и memory. Дополнительные сведения об этих средствах см. в разделе Bash, текстовый редактор, использование компьютера и память.
Поиск в Интернете Находите актуальные данные из реального мира со всего интернета, чтобы дополнить знания Claude. Для развертываний, размещенных в Azure, поддерживается только web_search_20250305 версия средства.
Получение веб-данных Извлекайте полное содержимое указанных веб-страниц и PDF-документов и проводите его углублённый анализ, дополняя контекст Claude актуальным веб-контентом. В Foundry для получения данных из веба требуется развертывание в инфраструктуре Anthropic. Для развертываний, размещенных в Azure, поддерживается только web_fetch_20250910 версия средства.

Инфраструктура инструментов

Находите, оркестрируйте и масштабируйте использование инструментов.

Функция Description
Детализированная потоковая передача инструментов Средство потоковой передачи использует параметры без буферизации или проверки JSON, уменьшая задержку для больших параметров. Требуется файл заголовка anthropic-betafine-grained-tool-streaming-2025-05-14.
Соединитель MCP Подключитесь к удаленным серверам MCP непосредственно из API сообщений без отдельного клиента MCP.
Поиск инструментов Масштабируйте систему до тысяч инструментов, динамически выявляя и загружая их по мере необходимости с помощью поиска на основе regex и BM25, оптимизируя использование контекста и повышая точность выбора инструментов. Для развертываний, размещенных в Azure, поддерживаются и tool_search_tool_bm25_20251119tool_search_tool_regex_20251119 версии инструментов. Устаревшие псевдонимы tool_search_tool_bm25 и tool_search_tool_regex также принимаются.

Управление контекстом

Управлять и оптимизировать контекстное окно Claude для длительных сеансов.

Функция Description
Автоматическое кэширование промптов Упростите кэширование промптов до одного параметра API. Система автоматически кэширует последний кэшируемый блок в запросе, перемещая точку кэша вперед по мере роста бесед.
Кэширование промптов (5 мин) Предоставьте Клоду дополнительные знания о фоновом опыте и примеры выходных данных, чтобы снизить затраты и задержку.
Кэширование промптов (1 ч) Расширенная продолжительность кэша за 1 час для менее часто доступного, но важного контекста, дополняющего стандартный 5-минутный кэш.
Редактирование контекста Автоматически управляйте контекстом диалога с помощью настраиваемых стратегий, включая очистку результатов инструментов и управление блоками рассуждений. Требуется заголовок anthropic-beta context-management-2025-06-27.
Подсчёт токенов Подсчет токенов позволяет вам определить количество токенов в сообщении перед его отправкой в Claude, что помогает вам принимать обоснованные решения о формулировке запросов и использовании.

Файлы и ресурсы

Управление документами и данными, которые вы предоставляете Claude.

Функция Description
API файлов В настоящее время доступно только в развертываниях, размещённых в инфраструктуре Anthropic. Отправка файлов и управление ими для использования с Claude без повторной отправки содержимого с каждым запросом. Поддерживает PDF-файлы, изображения и текстовые файлы.

Поддержка агента

  • Microsoft Agent Framework поддерживает создание агентов, использующих модели Claude.
  • Создайте пользовательских агентов ИИ с помощью Claude Agent SDK.

Типы развертывания и регионы

Модели Claude в Foundry доступны для следующих типов развертывания в определенных Azure регионах:

  • Global Standard: все модели Claude (размещенные на Azure и размещены в инфраструктуре Anthropic).
  • Data Zone Standard (US): размещается в версиях Azure для claude-opus-5, claude-opus-4-8 и claude-sonnet-5.

Сведения о точных регионах Azure, в которых модели Claude доступны для развертывания, см. в разделе Доступность регионов по типу развертывания.

Квоты и ограничения скорости

Ограничения скорости для моделей Claude зависят от модели, типа развертывания, версии размещения и типа подписки Azure. Ограничения измеряются количеством запросов в минуту (RPM), некэшированных входных токенов в минуту (ITPM) и выходных токенов в минуту (OTPM).

Сведения о текущих ограничениях, работе общей квоты и учете кэша промптов см. в разделе Квоты модели Claude и ограничения скорости.

Рекомендации по ответственному использованию искусственного интеллекта

При использовании моделей Claude в Foundry рассмотрите следующие ответственные методики ИИ:

Лучшие практики

Следуйте приведенным ниже рекомендациям при работе с моделями Claude в Foundry:

Инженерия подсказок

  • Четкие инструкции. Укажите конкретные и подробные запросы.
  • Управление контекстом: эффективно используйте доступное окно контекста.
  • Определения ролей: используйте системные сообщения для определения роли и поведения помощника.
  • Структурированные запросы: используйте согласованное форматирование для улучшения результатов.

Оптимизация затрат

Чтобы оптимизировать использование и избежать ограничения скорости, выполните приведенные ниже действия.

  • Реализуйте логику повторных попыток: обрабатывайте ответы 429 с экспоненциальной задержкой.
  • Пакетные запросы: Объединяйте несколько пропмтов по возможности.
  • Отслеживайте использование токенов: Отслеживайте расход токенов и характер запросов.
  • Используйте соответствующие модели: используйте наиболее эффективную модель для вашего варианта использования. См. доступные модели Claude.