Справочник локального интерфейса командной строки для Foundry

Important

  • Локальный интерфейс командной строки Foundry доступен в предварительной версии. Общедоступные предварительные версии предоставляют ранний доступ к функциям, которые находятся в процессе активного развертывания.
  • Функции, подходы и процессы могут изменяться или иметь ограниченные возможности до общедоступной доступности.

В этой статье содержится исчерпывающая справка по интерфейсу командной строки Foundry Local (CLI). Интерфейс командной строки упорядочивает команды в логические категории, помогая управлять моделями, управлять локальным сервером и поддерживать локальный кэш.

Необходимые условия

  • Установите Foundry Local.
  • Локальный терминал, в котором доступен ИНТЕРФЕЙС командной foundry строки.
  • Убедитесь, что у вас есть доступ к интернету для первого скачивания (поставщики выполнения и модели).
  • Azure RBAC: неприменимо (выполняется локально).
  • Если у вас есть NPU Intel на Windows, установите драйвер NPU Intel NPU для оптимального ускорения NPU.

Установка Foundry Local

Установите Foundry Local с помощью диспетчера пакетов для операционной системы.

  • Windows: откройте терминал и выполните следующую команду:
    winget install Microsoft.FoundryLocal
    
  • macOS: откройте терминал и выполните следующую команду:
    brew tap microsoft/foundrylocal
    brew install foundrylocal
    
    Кроме того, скачайте установщик из репозитория foundry-samples GitHub.

Проверьте установку:

foundry --version

Убедитесь, что у вас есть права администратора на установку программного обеспечения.

Tip

Если после установки появится ошибка подключения к службе (например, Request to local service failed), выполните команду foundry server restart.

Быстрая проверка

Выполните эти команды, чтобы подтвердить, что интерфейс командной строки установлен и служба доступна.

  1. Отобразить справку по CLI:

     foundry --help
    

    Эта команда выводит сведения об использовании и список доступных групп команд.

    Справочник. Обзор

  2. Проверьте состояние сервера:

состояние сервера foundry ''

Эта команда выводит, выполняется ли управляющая программа Foundry Local и включает ее локальную конечную точку.

Справочник. Команды сервера

Обзор

Используйте встроенную справку для изучения команд и параметров.

Интерфейс командной строки упорядочивает команды в следующие группы:

  • Модель: model, cache
  • Запуск: run, , chatcompletetranscribe
  • Сервер: server
  • Настройка: config
  • Справка: status, report

В следующей таблице перечислены команды верхнего уровня:

Command Description
foundry model Обнаруживает, проверяет, загружает, загружает и выгружает локальные модели.
foundry chat <model> Запускает интерактивный сеанс локального чата.
foundry complete <model> <prompt> Создает одно завершение текста без отслеживания состояния.
foundry run <model> Запускает модель с автоматической маршрутизацией в чат или транскрибирование.
foundry server Запускает, останавливает, перезапускает, проверяет и устраняет неполадки локальной управляющей программы Foundry.
foundry cache Проверяет и управляет скачанными записями кэша моделей.
foundry config Просмотры и изменение параметров постоянного интерфейса командной строки Foundry.
foundry status Отображает систему, службу, модель и диагностику подключения.
foundry report Открывает предварительно заполненную GitHub проблему с диагностикой.
foundry transcribe Запускает интерактивный сеанс транскрибирования речи или расшифровывает файл.

Команды модели

В следующей таблице приведены команды, связанные с управлением и выполнением моделей:

Note

Аргумент можно указать по model или идентификатору модели. Использование псевдонима:

  • Выбирает лучшую модель для доступного оборудования автоматически. Например, если у вас есть gpu Nvidia, Foundry Local выбирает лучшую модель GPU. Если у вас есть поддерживаемый NPU, Foundry Local выбирает модель NPU.
  • Позволяет использовать более короткое имя без необходимости запоминать идентификатор модели.

Если вы хотите запустить определенную модель, используйте идентификатор модели. Например, для запуска qwen2.5-0.5b на ЦП независимо от доступного оборудования используйте foundry run qwen2.5-0.5b-instruct-generic-cpu.

Command Description
foundry model --help Отображает все доступные команды, связанные с моделью, и их использование.
foundry model list Выводит список всех доступных моделей для локального использования. При первом запуске он загружает поставщиков исполнения (EP) для вашего оборудования.
foundry model info <model> Отображает подробные сведения о конкретной модели.
foundry model download <model> Загружает модель в локальный кэш без его запуска.
foundry model load <model> Загружает модель в службу.
foundry model unload <model> Выгружает модель из службы.

Сортировка списка моделей

Если для псевдонима доступно несколько вариантов идентификаторов модели, список моделей отображает модели в порядке приоритета. Первая модель в списке — это модель, которая выполняется, когда вы указываете модель с помощью alias.

Фильтрация списка моделей

Используйте явные параметры для foundry model list сужения или расширения результатов.

Note

При первом запуске foundry model list после установки Foundry Local автоматически скачивает соответствующие поставщики выполнения (EPS) для конфигурации оборудования компьютера. Отображается индикатор хода выполнения, указывающий завершение загрузки перед отображением списка моделей.

Вариант Description
--device <device> Фильтрует модели по устройству.
--type <type> Фильтрует модели по типу.
--search <query> Фильтрует модели по запросу поиска.
--cached Фильтрует список для кэшированных моделей.
--loaded Фильтрует список для загруженных моделей.
--variants Включает варианты модели в список.

Примеры

foundry model list --device gpu
foundry model list --type chat
foundry model list --search qwen
foundry model list --cached
foundry model list --loaded
foundry model list --variants

Эти примеры фильтруют или развертывают список моделей с помощью поддерживаемых параметров.

Справочник. Фильтрация списка моделей

Интерактивное выполнение модели

Запустите модель и взаимодействуйте с ней непосредственно в терминале:

foundry chat qwen2.5-0.5b

Foundry Local загружает модель при первом запуске, а затем запускает интерактивный сеанс. Введите запрос, чтобы получить ответ:

Why is the sky blue?

Tip

Замените qwen2.5-0.5b любым псевдонимом модели из каталога. Запустите foundry model list для просмотра доступных моделей. Foundry Local скачивает вариант, который лучше всего соответствует вашему оборудованию, например вариант CUDA для GPU NVIDIA или NPU для NPU для NPUs Qualcomm.

Команды сервера.

В следующей таблице приведены команды, связанные с управлением и запуском локальной службы Foundry:

Command Description
foundry server --help Отображает все доступные команды, связанные с сервером, и их использование.
foundry server start Запускает локальную управляющей программу Foundry и локальную службу, совместимую с OpenAI.
foundry server start --port <port> Запускает локальную службу на указанном TCP-порту. Используется 0 для порта, назначаемого ОС.
foundry server start --idle-timeout <minutes> Останавливает управляющая программа после указанного числа неактивных минут. Используется 0 для поддержания работы управляющей программы.
foundry server stop Останавливает управляющая программа Foundry Local.
foundry server restart Перезапуск управляющей программы Foundry Local и локальной службы.
foundry server restart --port <port> --idle-timeout 0 Перезапускает локальную службу на указанном TCP-порту и сохраняет управляющую программу.
foundry server status Отображает состояние управляющей программы, URL-адреса локальной службы, идентификатор процесса, время ожидания и расположение журнала.
foundry server logs Отображает журналы управляющей программы Foundry Local и SDK.

Локальный сервер с фиксированным портом

Чтобы запустить локальную службу на фиксированном порту и сохранить управляющую программу, используйте --port следующую команду:--idle-timeout 0

foundry server start --port 39839 --idle-timeout 0

Если управляющая программа уже запущена и необходимо применить новый порт, перезапустите его с теми же параметрами:

foundry server restart --port 39839 --idle-timeout 0

Чтобы проверить URL-адрес локальной конечной точки, выполните следующую команду:

foundry server status

Команды кэша

В следующей таблице приведены команды для управления локальным кэшем, в котором хранятся модели:

Command Description
foundry cache --help Отображает все доступные команды, связанные с кэшем, и их использование.
foundry cache location Отображает текущий каталог кэша.
foundry cache list Выводит список всех моделей, хранящихся в локальном кэше.
foundry cache cd <path> Изменяет каталог кэша на указанный путь.
foundry cache remove <model> Удаляет модель из локального кэша.

Поставщики выполнения

Поставщики выполнения — это аппаратно-специфичные библиотеки ускорения, которые выполняют модели как можно эффективнее на вашем устройстве.

Встроенные поставщики выполнения

Foundry Local включает исполнителя процессора, исполнителя WebGPU и исполнителя CUDA.

Поставщик выполнения ЦП использует Microsoft Линейная algebra Subroutines (MLAS) для запуска на любом ЦП и является резервным вариантом ЦП для Foundry Local.

Поставщик выполнения WebGPU использует Dawn, собственную реализацию веб-API для ускорения на любом GPU и является резервным вариантом GPU для Foundry Local.

Поставщик выполнения CUDA использует NVIDIA CUDA для ускорения на GPU NVIDIA. Для этого требуется серия NVIDIA GeForce RTX 30 и более поздних версий с минимальным рекомендуемым драйвером версии 32.0.15.5585 и CUDA версии 12.5. Это действует в соответствии с условиями следующего лицензионного соглашения: Лицензионное соглашение для комплектов средств разработки программного обеспечения NVIDIA — EULA.

Поставщики выполнения подключаемого модуля

Поставщики выполнения, перечисленные в следующей таблице, доступны для динамического скачивания и регистрации в Windows в зависимости от совместимости устройств и драйверов. Они подчиняются указанным условиям лицензии.

Foundry Local автоматически загружает эти поставщики выполнения при первом запуске. Провайдеры выполнения плагинов автоматически обновляются при появлении новых версий.

Имя (поставщик) Требования Условия лицензии
NvTensorRTRTXExecutionProvider (NVIDIA) NVIDIA GeForce RTX 30XX и более поздних версий с минимальным рекомендуемым драйвером версии 32.0.15.5585 и CUDA версии 12.5 Лицензионное соглашение для комплектов средств разработки программного обеспечения NVIDIA — EULA
OpenVINOExecutionProvider (Разведка) ЦП: Intel TigerLake (11-го поколения) и более поздних версий с минимальным рекомендуемым драйвером 32.0.100.9565
GPU: Intel AlderLake (12-го поколения) и более поздние версии с минимальным рекомендуемым драйвером 32.0.101.1029
NPU: Intel ArrowLake 15-го поколения и более поздние версии с минимальным рекомендуемым драйвером 32.0.100.4239
Лицензионное соглашение о коммерческом использовании дистрибутива Intel OBL версии 2025.02.12
QNNExecutionProvider (Qualcomm) Snapdragon(R) X Elite - X1Exxxxx - Qualcomm(R) Hexagon(TM) NPU с минимальной версией драйвера 30.0.140.0 и более поздними версиями
Snapdragon(R) X Plus - X1Pxxxxx - Qualcomm(R) Hexagon(TM) NPU с минимальной версией драйвера 30.0.140.0 и выше
Чтобы просмотреть лицензию QNN, скачайте пакет SDK для Нейронной обработки Qualcomm®, извлеките ZIP-файл и откройте файл LICENSE.pdf.
VitisAIExecutionProvider (AMD) Min: Adrenalin Edition 25.6.3 с драйвером NPU 32.00.0203.280
Max: Adrenalin Edition 25.9.1 с драйвером NPU 32.00.0203.297
Дополнительная лицензия не требуется

Использование Open WebUI с локальным сервером

Подключите Open WebUI к Foundry Local для интерфейса чата на основе браузера, который работает полностью на устройстве.

  1. Запустите модель и оставьте терминал открытым:

foundry run qwen2.5-0.5b


1. Get your local endpoint URL:

```bash
foundry server status

Скопируйте URL-адрес конечной точки. Foundry Local назначает динамический порт при каждом запуске службы.

  1. Установите и запустите Open WebUI, а затем откройте http://localhost:8080 в браузере.

  2. Подключение Open WebUI к Foundry Local:

    1. Перейдите в раздел "Параметры>администратора>" подключения и включите прямые подключения.
    2. Перейдите к разделу "Параметры>">"Управление прямыми подключениями" и выберите +пункт .
    3. Задайте ДЛЯ URL-адресаhttp://localhost:PORT/v1 (замените PORT порт на шаге 2) и запустите проверку подлинности в значение None.
    4. Нажмите Сохранить.
  3. Выберите модель из раскрывающегося списка и запустите чат.

Tip

Если модели не отображаются, запустите foundry run <model> в терминале и перезагрузите Open WebUI. Если подключение завершается ошибкой, подтвердите порт с foundry server statusпомощью .

Обновление платформы локального уровня

Выполните команду для операционной системы, чтобы обновить Foundry Local.

  • Windows:
    winget upgrade --id Microsoft.FoundryLocal
    
  • macOS
    brew upgrade foundrylocal
    

Удаление Foundry Local

Выполните команду для операционной системы, чтобы удалить Foundry Local.

  • Windows:
    winget uninstall Microsoft.FoundryLocal
    
  • macOS
    brew rm foundrylocal
    brew untap microsoft/foundrylocal
    brew cleanup --scrub
    

Troubleshooting

Проблемы с подключением к службе

Если при выполнении команды foundry model listвы увидите следующую ошибку:

Exception: Request to local service failed.
Uri: http://127.0.0.1:0/foundry/list

The requested address is not valid in its context. (127.0.0.1:0)

Please check service status with 'foundry server status'.

Перезапустите службу :

foundry server restart

Эта команда исправляет случаи, когда сервер выполняется, но недоступен из-за проблемы привязки портов.

Дополнительные рекомендации по устранению неполадок см. в рекомендациях и устранении неполадок.