Доступные модели в Unity Gateway

Databricks размещает новейшие партнёрские модели и модели с открытыми весами. Используйте Unity Gateway для доступа к этим моделям приложений, агентов для кодирования и ИИ-рабочих нагрузок на ваших данных.

Начинайте отправлять запросы на модели.

Модели, доступные через Databricks

Следующие модели размещены на Databricks. Название каждой модели связано с её спецификациями.

Модельные активы system.ai представлены по всему миру. Видение модели там не означает, что она доступна в вашем рабочем пространстве. Доступность зависит от региона вашего рабочего пространства, настроек между географиями и доступности моделей. Проверьте в интерфейсе Unity Gateway наличие соответствующего сервиса модели и убедитесь, что у вас есть права на выполнение запросов к нему.

Указание модели не отправляет к ней данные клиента для вывода. См. раздел «Доступность моделей по регионам » для региональной информации.

Заметка

На Azure Databricks модели OpenAI и Google Gemini, а также Zhipu AI GLM 5.3, GLM 5.3 Flash и GLM 5.2, Moonshot AI Kimi K3, Thinking Machine Labs Inkling, а также DeepSeek V4.1 Flash и V4 Flash доступны через ADI Services, предоставляемые Databricks. Для описания этих моделей см. Подробный список моделей, поддерживаемых API Databricks Foundation Model. Для настройки и доступа см. раздел ADI Services.

Provider Семейство моделей Модели
Антропный Клод Хайку Клод Хайку 4.5
Антропный Клод Соннет Сонет Клод 5.5, Сонет Клод 5, Сонет Клод 4.6, Сонет Клод 4.5
Антропный Клод Fable Клод Фейбл 5.1, Клод Фейбл 5
Антропный Клод Опус Клод Опус 5, Клод Опус 4.8, Клод Опус 4.7, Клод Опус 4.6, Клод Опус 4.5, Клод Опус 4.1
OpenAI GPT GPT-6 Astra, GPT-5.6 Sol, GPT-5.6 Terra, GPT-5.6 Luna, GPT-5.5 Pro, GPT-5.5, GPT-5.4, GPT-5.4 mini, GPT-5.4 nano, GPT-5.2, GPT-5.1, GPT-5, GPT-5 mini, GPT-5 nano
OpenAI GPT Codex Кодекс GPT-5.3
OpenAI GPT OSS GPT OSS 120B, GPT OSS 20B
Google Gemini Flash Gemini 3.6 Flash, Gemini 3.5 Flash, Gemini 3.5 Flash Lite, Gemini 3.1 Flash Lite, Gemini 3 Flash
Google Gemini Pro Предварительный обзор Gemini 3.1 Pro
Google Генерация изображений Gemini Gemini 3.1 Flash Image, Gemini 3 Pro Image
Google Джемма Gemma 3 12B
Meta Лама Лама 4 Маверик, Лама 3.3 70B Инструктировать, Лама 3.1 8B Инструктировать
Alibaba Cloud Qwen OpenJev (Qwen3.5 4B), Qwen3.5 122B A10B, Qwen3-Embedding-0.6B, Qwen3-Next 80B A3B Instruct
Прорывной ИИ Кими Кими K3
Zhipu AI GLM GLM 5.3, GLM 5.3 Flash, GLM 5.2
DeepSeek DeepSeek V4.1 Flash, V4 Flash (0731)
Лаборатории мыслящей машины Намёк Inkling
Alibaba ГТЭ GTE Large (En)

Для устаревших моделей и рекомендуемых замен см. Устаревшие и списанные модели.

Используйте модель

Задача Как использовать модели
Создайте приложение или агент Вызовите модель через API Unity Gateway. Сервисы моделей, предоставляемые системой в system.ai позволяют начать работу без создания пользовательского сервиса модели. См. Запросные модели.
Применяйте ИИ к своим данным Используйте ai_query для отправки запросов в поддерживаемую модель из SQL, ноутбуков или пакетных конвейеров. См. Use ai_query.
Использование агента программирования Подключите ваш программный агент к моделям через Unity Gateway. См. Поддерживаемые кодирующие агенты.

Поддерживаемые модели и идентификаторы моделей различаются в зависимости от интерфейса. Смотрите ссылку на руководства с требованиями и примерами.

Сервисы моделей, предоставляемые системой

Azure Databricks предоставляет готовые к использованию сервисы моделей с оплатой за токен в system.ai.claude-opus-5, например system.ai. Новые сервисы добавляются по мере появления базовых моделей.

  • Системный пользователь владеет им, и их нельзя удалить.
  • По умолчанию только администраторы хранилища метаданных могут изменять их. Администратор хранилища метаданных может делегировать управление, предоставив привилегию MANAGE .

Чтобы ограничить доступ, см. раздел «Обнаружение служб моделей и управление доступом к ним».

Выберите объём порций

Опция Рекомендуется для Принцип работы
Оплата за токен Рабочие нагрузки с переменным или прерывистым использованием. Платите только за используемые токены без выделения отдельных вычислительных мощностей.
Пропускная способность по требованию Нагрузки, требующие выделенной ёмкости с гибкостью для их корректировки по мере изменения требований. Оплачивайте выделенные мощности без срочных обязательств.

Сервисы модели Unity Gateway могут маршрутизироваться к назначениям с предоставленной пропускной способностью. Ознакомьтесь с документацией по каждой опции с подходящими моделями и требованиями к настройке.

Для пакетного инференса с ai_query используйте руководство по AI Functions, чтобы выбрать поддерживаемые модели и варианты обслуживания. Поддержка моделей и регионов зависит от варианта развертывания.

Подключите других поставщиков моделей

Вы также можете использовать Unity Gateway с собственной учётной записью у поставщика модели. Подключите поставщика модели и управляйте доступом, используя учетные данные вашей организации.

См. Подключить внешнего поставщика моделей.

Связанная информация