Catatan
Akses ke halaman ini memerlukan otorisasi. Anda dapat mencoba masuk atau mengubah direktori.
Akses ke halaman ini memerlukan otorisasi. Anda dapat mencoba mengubah direktori.
Important
- Foundry Local CLI tersedia dalam pratinjau. Rilis pratinjau publik menyediakan access awal untuk fitur yang berada dalam penyebaran aktif.
- Fitur, pendekatan, dan proses dapat berubah atau memiliki kemampuan terbatas, sebelum Ketersediaan Umum (GA).
Artikel ini menyediakan referensi komprehensif untuk antarmuka baris perintah (CLI) Foundry Local. CLI mengatur perintah ke dalam kategori logis untuk membantu Anda mengelola model, mengontrol server lokal, dan memelihara cache lokal Anda.
Prasyarat
- Instal Foundry Local.
- Terminal lokal tempat
foundryCLI tersedia. - Pastikan Anda memiliki akses internet untuk pengunduhan pertama (penyedia eksekusi dan model).
- Azure RBAC: Tidak berlaku (berjalan secara lokal).
- Jika Anda memiliki Intel NPU pada Windows, instal driver NPU Intel untuk akselerasi NPU yang optimal.
Instal Foundry Local
Instal Foundry Local dengan menggunakan manajer paket untuk sistem operasi Anda.
-
Windows: Buka terminal dan jalankan:
winget install Microsoft.FoundryLocal -
macOS: Buka terminal dan jalankan:
Atau, unduh alat penginstal dari repositori GitHub foundry-samples.brew tap microsoft/foundrylocal brew install foundrylocal
Verifikasi penginstalan:
foundry --version
Pastikan Anda memiliki hak admin untuk menginstal perangkat lunak.
Tip
Jika Anda melihat kesalahan koneksi layanan setelah penginstalan (misalnya, Request to local service failed), jalankan foundry server restart.
Verifikasi cepat
Jalankan perintah ini untuk mengonfirmasi bahwa CLI diinstal dan layanan dapat dijangkau.
Tampilkan bantuan CLI:
foundry --helpPerintah ini mencetak informasi penggunaan dan daftar grup perintah yang tersedia.
Referensi: Gambaran Umum
Periksa status server:
status server foundry '''
Perintah ini mencetak apakah daemon Foundry Local berjalan dan menyertakan titik akhir lokalnya.
Referensi: Perintah server
Ikhtisar
Gunakan bantuan bawaan untuk menjelajahi perintah dan opsi.
CLI mengatur perintah ke dalam grup berikut:
-
Model:
model,cache -
Jalankan:
run,chat,complete,transcribe -
Server:
server -
Penyetelan:
config -
Bantuan:
status,report
Tabel berikut ini meringkas perintah tingkat atas:
| Command | Description |
|---|---|
foundry model |
Menemukan, memeriksa, mengunduh, memuat, dan membongkar model lokal. |
foundry chat <model> |
Memulai sesi obrolan lokal interaktif. |
foundry complete <model> <prompt> |
Menghasilkan satu penyelesaian teks stateless. |
foundry run <model> |
Menjalankan model dengan perutean otomatis ke obrolan atau transkripsi. |
foundry server |
Memulai, menghentikan, memulai ulang, memeriksa, dan memecahkan masalah daemon Foundry lokal. |
foundry cache |
Memeriksa dan mengelola entri cache model yang diunduh. |
foundry config |
Menampilkan dan mengedit pengaturan CLI Foundry persisten. |
foundry status |
Menampilkan diagnostik sistem, layanan, model, dan konektivitas. |
foundry report |
Membuka masalah GitHub yang telah diisi sebelumnya dengan diagnostik. |
foundry transcribe |
Memulai sesi transkripsi ucapan lokal interaktif atau mentranskripsikan file. |
Perintah model
Tabel berikut ini meringkas perintah yang terkait dengan mengelola dan menjalankan model:
Nota
Anda dapat menentukan model argumen dengan alias atau ID modelnya. Menggunakan alias:
- Memilih model terbaik untuk perangkat keras yang tersedia secara otomatis. Misalnya, jika Anda memiliki GPU Nvidia yang tersedia, Foundry Local memilih model GPU terbaik. Jika Anda memiliki NPU yang tersedia dan didukung, Foundry Local akan memilih model NPU.
- Memungkinkan Anda menggunakan nama yang lebih pendek tanpa perlu mengingat ID model.
Jika Anda ingin menjalankan model tertentu, gunakan ID model. Misalnya, untuk menjalankan qwen2.5-0.5b pada CPU, terlepas dari perangkat keras Anda yang tersedia, gunakan foundry run qwen2.5-0.5b-instruct-generic-cpu.
| Command | Description |
|---|---|
foundry model --help |
Menampilkan semua perintah terkait model yang tersedia dan penggunaannya. |
foundry model list |
Mencantumkan semua model yang tersedia untuk penggunaan lokal. Pada eksekusi pertama, ia mengunduh penyedia eksekusi (EPs) untuk perangkat keras Anda. |
foundry model info <model> |
Menampilkan informasi terperinci tentang model tertentu. |
foundry model download <model> |
Mengunduh model ke cache lokal tanpa menjalankannya. |
foundry model load <model> |
Memuat model ke dalam layanan. |
foundry model unload <model> |
Menghapus model dari layanan. |
Pengurutan daftar model
Saat beberapa varian ID model tersedia untuk alias, daftar model menampilkan model dalam urutan prioritas. Model pertama dalam daftar adalah model yang berjalan saat Anda menentukan model dengan alias.
Pemfilteran daftar model
Gunakan opsi eksplisit untuk foundry model list mempersempit atau memperluas hasilnya.
Nota
Saat Anda menjalankan foundry model list untuk pertama kalinya setelah penginstalan, Foundry Local secara otomatis mengunduh penyedia eksekusi (EP) yang relevan untuk konfigurasi perangkat keras komputer Anda. Anda melihat bilah kemajuan yang menunjukkan penyelesaian unduhan sebelum daftar model muncul.
| Option | Description |
|---|---|
--device <device> |
Memfilter model menurut perangkat. |
--type <type> |
Memfilter model menurut jenis. |
--search <query> |
Memfilter model menurut kueri pencarian. |
--cached |
Memfilter daftar ke model yang di-cache. |
--loaded |
Memfilter daftar ke model yang dimuat. |
--variants |
Menyertakan varian model dalam daftar. |
Examples
foundry model list --device gpu
foundry model list --type chat
foundry model list --search qwen
foundry model list --cached
foundry model list --loaded
foundry model list --variants
Contoh ini memfilter atau memperluas daftar model dengan menggunakan opsi yang didukung.
Referensi: Pemfilteran daftar model
Menjalankan model secara interaktif
Jalankan model dan berinteraksi dengannya langsung di terminal:
foundry chat qwen2.5-0.5b
Foundry Local mengunduh model saat pertama kali dijalankan, lalu memulai sesi interaktif. Masukkan perintah untuk mendapatkan respons:
Why is the sky blue?
Tip
Ganti qwen2.5-0.5b dengan alias model apa pun dari katalog. Jalankan foundry model list untuk melihat model yang tersedia. Foundry Local mengunduh varian yang paling cocok dengan perangkat keras Anda — misalnya, varian CUDA untuk GPU NVIDIA atau varian NPU untuk NPU Qualcomm.
Perintah server
Tabel berikut ini meringkas perintah yang terkait dengan pengelolaan dan menjalankan layanan Foundry Local:
| Command | Description |
|---|---|
foundry server --help |
Menampilkan semua perintah terkait server yang tersedia dan penggunaannya. |
foundry server start |
Memulai daemon Lokal Foundry dan layanan lokal yang kompatibel dengan OpenAI. |
foundry server start --port <port> |
Memulai layanan lokal pada port TCP yang ditentukan. Gunakan 0 untuk port yang ditetapkan OS. |
foundry server start --idle-timeout <minutes> |
Menghentikan daemon setelah jumlah menit tidak aktif yang ditentukan. Gunakan 0 untuk menjaga daemon tetap berjalan. |
foundry server stop |
Menghentikan daemon Foundry Local. |
foundry server restart |
Memulai ulang daemon Lokal Foundry dan layanan lokal. |
foundry server restart --port <port> --idle-timeout 0 |
Memulai ulang layanan lokal pada port TCP yang ditentukan dan menjaga daemon tetap berjalan. |
foundry server status |
Menampilkan status daemon, URL layanan lokal, ID proses, waktu aktif, dan lokasi log. |
foundry server logs |
Menampilkan daemon Lokal Foundry dan log SDK. |
Server lokal port tetap
Untuk memulai layanan lokal pada port tetap dan menjaga daemon tetap berjalan, gunakan --port dengan --idle-timeout 0:
foundry server start --port 39839 --idle-timeout 0
Jika daemon sudah berjalan dan Anda perlu menerapkan port baru, mulai ulang dengan opsi yang sama:
foundry server restart --port 39839 --idle-timeout 0
Untuk memverifikasi URL titik akhir lokal, jalankan:
foundry server status
Perintah cache
Tabel berikut ini meringkas perintah untuk mengelola cache lokal tempat model disimpan:
| Command | Description |
|---|---|
foundry cache --help |
Memperlihatkan semua perintah terkait cache yang tersedia dan penggunaannya. |
foundry cache location |
Memperlihatkan direktori cache saat ini. |
foundry cache list |
Mencantumkan semua model yang disimpan dalam cache lokal. |
foundry cache cd <path> |
Mengubah direktori cache ke jalur yang ditentukan. |
foundry cache remove <model> |
Menghapus model dari cache lokal. |
Penyedia pelaksanaan
Penyedia eksekusi adalah pustaka akselerasi khusus perangkat keras yang menjalankan model seefisien mungkin di perangkat Anda.
Penyedia eksekusi bawaan
Foundry Local mencakup penyedia eksekusi CPU, penyedia eksekusi WebGPU, dan penyedia eksekusi CUDA.
Penyedia eksekusi CPU menggunakan Microsoft Linear Algebra Subroutines (MLAS) untuk berjalan pada CPU apa pun dan merupakan fallback CPU untuk Foundry Local.
Penyedia pelaksana WebGPU menggunakan Dawn, implementasi asli dari API berbasis web, untuk akselerasi pada GPU apa pun, dan merupakan cadangan GPU untuk Foundry Local.
Penyedia eksekusi CUDA menggunakan NVIDIA CUDA untuk akselerasi pada GPU NVIDIA. Ini memerlukan seri NVIDIA GeForce RTX 30 dan yang lebih baru dengan driver minimum yang direkomendasikan versi 32.0.15.5585 dan CUDA versi 12.5. Ini tunduk pada persyaratan lisensi berikut: Perjanjian Lisensi untuk Kit Pengembangan Perangkat Lunak NVIDIA—EULA.
Penyedia pelaksanaan plugin
Penyedia eksekusi yang tercantum dalam tabel berikut ini tersedia untuk unduhan dan pendaftaran dinamis pada Windows, tergantung pada kompatibilitas perangkat dan driver. Mereka tunduk pada persyaratan lisensi yang ditentukan.
Foundry Local secara otomatis mengunduh penyedia eksekusi ini saat pertama kali dijalankan. Penyedia eksekusi plugin secara otomatis memperbarui ketika versi baru tersedia.
| Nama (Vendor) | Persyaratan | Ketentuan lisensi |
|---|---|---|
NvTensorRTRTXExecutionProvider (NVIDIA) |
NVIDIA GeForce RTX 30XX dan versi yang lebih baru dengan driver minimum yang direkomendasikan versi 32.0.15.5585 dan CUDA versi 12.5 | Perjanjian Lisensi untuk Kit Pengembangan Perangkat Lunak NVIDIA—EULA |
OpenVINOExecutionProvider (Intel) |
CPU: Intel TigerLake (Generasi ke-11) dan versi selanjutnya dengan driver minimum yang direkomendasikan 32.0.100.9565 GPU: Intel AlderLake (Gen ke-12) dan versi yang lebih baru dengan driver yang direkomendasikan min 32.0.101.1029 NPU: Intel ArrowLake generasi ke-15 dan versi-versi selanjutnya dengan driver minimum yang direkomendasikan 32.0.100.4239 |
Perjanjian Lisensi Penggunaan Komersial Distribusi Intel OBL v2025.02.12 |
QNNExecutionProvider (Qualcomm) |
Snapdragon(R) X Elite - X1Exxxxx - Qualcomm(R) Hexagon(TM) NPU dengan driver minimum versi 30.0.140.0 dan versi yang lebih baru Snapdragon(R) X Plus - X1Pxxxxx - Qualcomm(R) Hexagon(TM) NPU dengan driver minimum versi 30.0.140.0 dan versi yang lebih baru |
Untuk melihat Lisensi QNN, unduh Qualcomm® Neural Processing SDK, ekstrak ZIP, dan buka file LICENSE.pdf. |
VitisAIExecutionProvider (AMD) |
Min: Adrenalin Edition 25.6.3 dengan driver NPU 32.00.0203.280 Maks: Adrenalin Edition 25.9.1 dengan driver NPU 32.00.0203.297 |
Tidak diperlukan lisensi tambahan |
Menggunakan Open WebUI dengan server lokal
Sambungkan Open WebUI ke Foundry Local untuk antarmuka obrolan berbasis browser yang berjalan sepenuhnya di perangkat Anda.
Mulai model dan biarkan terminal terbuka:
foundry run qwen2.5-0.5b
1. Get your local endpoint URL:
```bash
foundry server status
Salin URL titik akhir. Foundry Local menetapkan port dinamis setiap kali layanan dimulai.
Instal dan luncurkan Open WebUI, lalu buka
http://localhost:8080di browser Anda.Sambungkan Open WebUI ke Foundry Local:
- Buka Pengaturan>Pengaturan>Koneksi Admin dan aktifkan Koneksi Langsung.
- Buka Pengaturan>Koneksi>Kelola Koneksi Langsung dan pilih +.
- Atur URL ke
http://localhost:PORT/v1(gantiPORTdengan port dari langkah 2) dan Auth ke Tidak Ada. - Pilih Simpan.
Pilih model dari menu dropdown dan mulai mengobrol.
Tip
Jika tidak ada model yang muncul, jalankan foundry run <model> di terminal dan muat ulang Open WebUI. Jika koneksi gagal, konfirmasikan port dengan foundry server status.
Mutakhirkan Foundry Local
Jalankan perintah untuk sistem operasi Anda untuk memutakhirkan Foundry Local.
-
Windows:
winget upgrade --id Microsoft.FoundryLocal -
macOS:
brew upgrade foundrylocal
Copot pemasangan Foundry Local
Jalankan perintah untuk sistem operasi Anda untuk menghapus instalasi Foundry Local.
-
Windows:
winget uninstall Microsoft.FoundryLocal -
macOS:
brew rm foundrylocal brew untap microsoft/foundrylocal brew cleanup --scrub
Troubleshooting
Masalah koneksi layanan
Jika Anda melihat kesalahan ini saat menjalankan perintah seperti foundry model list:
Exception: Request to local service failed.
Uri: http://127.0.0.1:0/foundry/list
The requested address is not valid in its context. (127.0.0.1:0)
Please check service status with 'foundry server status'.
Mulai ulang layanan :
foundry server restart
Perintah ini memperbaiki kasus di mana server berjalan tetapi tidak dapat diakses karena masalah pengikatan port.
Untuk panduan pemecahan masalah selengkapnya, lihat Praktik terbaik dan pemecahan masalah.