Poznámka:
Přístup k této stránce vyžaduje autorizaci. Můžete se zkusit přihlásit nebo změnit adresáře.
Přístup k této stránce vyžaduje autorizaci. Můžete zkusit změnit adresáře.
Microsoft Foundry Models v katalogu modelů tvoří dvě hlavní kategorie, konkrétně Foundry Models prodané Azure a Foundry Models od partnerů a komunity. Tento článek uvádí výběr modelů Foundry prodaných Azure spolu s jejich schopnostmi, typy nasazení a oblastmi dostupnosti, s výjimkou zastaralých a vyřazených modelů. Modely Foundry prodané Azure se také označují jako Direct from Azure Models nebo Azure Direct Models.
Modely prodávané společností Azure jsou také hostovány a provozovány společností Azure jako součást služby Foundry Models. Zahrnují všechny modely OpenAI Azure a konkrétní modely vybrané od hlavních poskytovatelů. Tyto modely se účtují prostřednictvím vašeho předplatného Azure, na které se vztahují smlouvy o úrovni služeb Azure a podporované Microsoft. Pokud chcete zobrazit seznam modelů Foundry podporovaných službou Foundry Agent Service, podívejte se na modely podporované službou Agent Service a seznam modelů Foundry od partnerů najdete v tématu Modely Foundry od partnerů a komunity.
Tip
Pomocí karet v horní části této stránky můžete přepínat mezi Azure modely OpenAI a Other model collections od poskytovatelů, jako jsou Cohere, DeepSeek, Meta, Mistral AI a xAI.
Azure OpenAI v modelech Microsoft Foundry
Azure OpenAI využívá různorodou sadu modelů s různými možnostmi a cenovými body. Dostupnost modelu se liší podle oblastí a cloudu.
- Informace o dostupnosti oblastí pro Azure OpenAI v modelech Microsoft Foundry seskupených podle kategorie nasazení najdete v článku Dostupnost oblastí pro modely Foundry prodávané prostřednictvím Azure.
- Dostupnost modelu Azure Government najdete v Azure OpenAI v Azure Government.
Zvýraznění modelu
| Modely | Popis |
|---|---|
| Řada GPT-5.6 |
NEWgpt-5.6-sol, , gpt-5.6-terragpt-5.6-lunaPreview |
| GPT-chat-latest (Preview) |
NOVÉgpt-chat-latestNáhled |
| Řada GPT-5.5 |
NOVÉgpt-5.5 |
| Řada GPT-5.4 |
gpt-5.4-mini, gpt-5.4-nano, , gpt-5.4gpt-5.4-pro |
| Řada GPT-5.3 |
gpt-5.3-chat, gpt-5.3-codex |
| Řada GPT-5.2 |
gpt-5.2-codex, , gpt-5.2gpt-5.2-chatPreview |
| Řada GPT-5.1 |
gpt-5.1, gpt-5.1-chatPreview, gpt-5.1-codex, gpt-5.1-codex-mini |
| Sora | NOVÝ sora-2 |
| Řada GPT-5 |
gpt-5, , gpt-5-mini, gpt-5-nanogpt-5-chatPreview |
| gpt-oss | modely pro usuzování s otevřenými váhami |
| codex-mini | Jemně vyladěná verze o4-mini. |
| Řada GPT-4.1 |
gpt-4.1, gpt-4.1-mini, gpt-4.1-nano |
| náhled pro použití počítače | Experimentální model natrénovaný pro použití s nástrojem rozhraní API Responses. |
| Modely o-series | Modely uvažování s pokročilým řešením problémů, zvýšeným zaměřením a schopnostmi. |
| GPT-4o, GPT-4o mini a GPT-4 Turbo | Schopné Azure modely OpenAI s vícemodálními verzemi, které můžou jako vstup přijímat text i obrázky. |
| Vkládání | Sada modelů, které mohou převést text do číselné vektorové formy, aby se usnadnila podobnost textu. |
| Generování obrázků | Řada modelů, které můžou generovat původní obrázky z přirozeného jazyka. |
Video generation |
Model, který může generovat původní video scény z textových instrukcí. |
| Audio | Řada modelů pro převod řeči na text, překlad a převod textu na řeč. Zvukové modely GPT-4o podporují buď konverzační interakce s nízkou latencí se vstupem i výstupem řeči, nebo generování audia. |
GPT-chat-nejnovější
Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.
Schopnosti
| ID modelu | Popis | Kontextové okno | Maximální počet výstupních tokenů | Trénovací data (až do) |
|---|---|---|---|---|
gpt-chat-latest (2026-06-24)Náhled |
-
Uvažování – Rozhraní API pro dokončování chatů - Rozhraní API pro odpovědi - Strukturované výstupy – Funkce, nástroje a paralelní volání nástrojů. |
128,000 Vstup: 111 616 Výstup: 16 384 |
16,384 | Srpen 2025 |
gpt-chat-latest (2026-05-28)Náhled |
-
Uvažování – Rozhraní API pro dokončování chatů - Rozhraní API pro odpovědi - Strukturované výstupy – Funkce, nástroje a paralelní volání nástrojů. |
128,000 Vstup: 111 616 Výstup: 16 384 |
16,384 | Srpen 2025 |
gpt-chat-latest (2026-05-05)Náhled |
-
Uvažování – Rozhraní API pro dokončování chatů - Rozhraní API pro odpovědi - Strukturované výstupy – Funkce, nástroje a paralelní volání nástrojů. |
128,000 Vstup: 111 616 Výstup: 16 384 |
16,384 | Srpen 2025 |
Poznámka
Tento model se také může zobrazit podle OpenAI jako GPT-5.5 Instant nebo v rozhraní OpenAI API jako chat-latest. V Microsoft Foundry je název produktu pro tuto verzi gpt-chat-latest. Model nadále sleduje stávající životní cyklus verze Preview a standardní období oznámení. Tým také vyhodnocuje způsoby zjednodušení přístupu zákazníků k nepřetržitě aktualizovaným modelům v průběhu času, ale současné chování zůstává beze změny, protože tato práce pokračuje.
GPT-5.6
Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.
Důležité
V rámci postupného zavedení se přístup k modelům řady GPT-5.6 postupně rozšiřuje na zákazníky. Microsoft sdílí aktualizace, protože onboarduje více zákazníků.
Schopnosti
| ID modelu | Popis | Kontextové okno | Maximální počet výstupních tokenů | Trénovací data (až do) |
|---|---|---|---|---|
gpt-5.6-sol (2026-07-09) |
-
Uvažování - Rozhraní API pro odpovědi – Rozhraní API pro dokončování chatů - Strukturované výstupy. - Zpracování textu a obrázku. – Funkce, nástroje a paralelní volání nástrojů. - Použití počítače - Úplný souhrn možností |
1,050,000 Vstup: 922 000 Výstup: 128 000 |
128,000 | Červen 2026 |
gpt-5.6-terra (2026-07-09) |
-
Uvažování - Rozhraní API pro odpovědi – Rozhraní API pro dokončování chatů - Strukturované výstupy. - Zpracování textu a obrázku. – Funkce, nástroje a paralelní volání nástrojů. - Použití počítače - Úplný souhrn možností |
1,050,000 Vstup: 922 000 Výstup: 128 000 |
128,000 | Červen 2026 |
gpt-5.6-luna (2026-07-09) |
-
Uvažování - Rozhraní API pro odpovědi – Rozhraní API pro dokončování chatů - Strukturované výstupy. - Zpracování textu a obrázku. – Funkce, nástroje a paralelní volání nástrojů. - Použití počítače - Úplný souhrn možností |
1,050,000 Vstup: 922 000 Výstup: 128 000 |
128,000 | Červen 2026 |
GPT-5.5
Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.
Schopnosti
| ID modelu | Popis | Kontextové okno | Maximální počet výstupních tokenů | Trénovací data (až do) |
|---|---|---|---|---|
gpt-5.5 (2026-04-24) |
-
Uvažování - Rozhraní API pro odpovědi – Rozhraní API pro dokončování chatů - Strukturované výstupy. - Zpracování textu a obrázku. – Funkce, nástroje a paralelní volání nástrojů. - Použití počítače - Úplný souhrn možností |
1,050,000 Vstup: 922 000 Výstup: 128 000 |
128,000 | Prosinec 2025 |
Poznámka
Některé úrovně kvót budou vyžadovat žádosti o kvóty, gpt-5.5 aby bylo možné tento model nasadit. Předplatná vrstvy 5 a vrstvy 6 mají ve výchozím nastavení kvótu.
GPT-5.4
Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.
Schopnosti
| ID modelu | Popis | Kontextové okno | Maximální počet výstupních tokenů | Trénovací data (až do) |
|---|---|---|---|---|
gpt-5.4 (2026-03-05) |
-
Uvažování - Rozhraní API pro odpovědi – Rozhraní API pro dokončování chatů - Strukturované výstupy. - Zpracování textu a obrázku. – Funkce, nástroje a paralelní volání nástrojů. - Použití počítače - Úplný souhrn možností |
1,050,000 Vstup: 922 000 Výstup: 128 000 |
128,000 | Srpen 2025 |
gpt-5.4-pro (2026-03-05) |
-
Uvažování - Rozhraní API pro odpovědi - Zpracování textu a obrázku. - Funkce a nástroje - Úplný souhrn možností |
1,050,000 Vstup: 922 000 Výstup: 128 000 |
128,000 | Srpen 2025 |
gpt-5.4-mini (2026-03-17) |
-
Uvažování - Rozhraní API pro odpovědi – Rozhraní API pro dokončování chatů - Strukturované výstupy. - Zpracování textu a obrázku. – Funkce, nástroje a paralelní volání nástrojů. - Použití počítače - Úplný souhrn možností |
400,000 Vstup: 272 000 Výstup: 128 000 |
128,000 | Srpen 2025 |
gpt-5.4-nano (2026-03-17) |
-
Uvažování - Rozhraní API pro odpovědi – Rozhraní API pro dokončování chatů - Strukturované výstupy. - Zpracování textu a obrázku. – Funkce, nástroje a paralelní volání nástrojů. - Úplný souhrn možností |
400,000 Vstup: 272 000 Výstup: 128 000 |
128,000 | Srpen 2025 |
GPT-5.3
Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.
Schopnosti
| ID modelu | Popis | Kontextové okno | Maximální počet výstupních tokenů | Trénovací data (až do) |
|---|---|---|---|---|
gpt-5.3-codex (2026-02-24) |
-
Uvažování - Rozhraní API pro odpovědi - Strukturované výstupy. - Zpracování textu a obrázku. – Funkce, nástroje a paralelní volání nástrojů. - Úplný souhrn možností - Optimalizované pro rozšíření Codex CLI a Codex VS Code |
400,000 Vstup: 272 000 Výstup: 128 000 |
128,000 | Srpen 2025 |
gpt-5.3-chat (2026-03-03)Náhled |
– Rozhraní API pro dokončování chatů - Rozhraní API pro odpovědi - Strukturované výstupy – Funkce, nástroje a paralelní volání nástrojů. |
128,000 Vstup: 111 616 Výstup: 16 384 |
16,384 | Srpen 2025 |
GPT-5.2
Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.
Schopnosti
| ID modelu | Popis | Kontextové okno | Maximální počet výstupních tokenů | Trénovací data (až do) |
|---|---|---|---|---|
gpt-5.2-codex (2026-01-14) |
-
Uvažování - Rozhraní API pro odpovědi - Strukturované výstupy. - Zpracování textu a obrázku. – Funkce, nástroje a paralelní volání nástrojů. - Úplný souhrn možností - Optimalizované pro rozšíření Codex CLI a Codex VS Code |
400,000 Vstup: 272 000 Výstup: 128 000 |
128,000 | |
gpt-5.2 (2025-12-11) |
-
Uvažování – Rozhraní API pro dokončování chatů - Rozhraní API pro odpovědi - Strukturované výstupy. - Zpracování textu a obrázku. – Funkce, nástroje a paralelní volání nástrojů. - Úplný souhrn možností |
400,000 Vstup: 272 000 Výstup: 128 000 |
128,000 | Srpen 2025 |
gpt-5.2-chat (2025-12-11)Náhled |
– Rozhraní API pro dokončování chatů - Rozhraní API pro odpovědi - Strukturované výstupy – Funkce, nástroje a paralelní volání nástrojů. |
128,000 Vstup: 111 616 Výstup: 16 384 |
16,384 | Srpen 2025 |
gpt-5.2-chat (2026-02-10)Náhled |
– Rozhraní API pro dokončování chatů - Rozhraní API pro odpovědi - Strukturované výstupy – Funkce, nástroje a paralelní volání nástrojů. |
128,000 Vstup: 111 616 Výstup: 16 384 |
16,384 | Srpen 2025 |
Pozor
Nedoporučujeme používat modely Preview v produkčním prostředí. Upgradujeme všechna nasazení modelů Preview na budoucí verze Preview nebo na nejnovější stabilní obecně dostupnou verzi. Modely, které jsou určené verze Preview, nedodržují standardní Azure životní cyklus modelu OpenAI.
GPT-5.1
Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.
Schopnosti
| ID modelu | Popis | Kontextové okno | Maximální počet výstupních tokenů | Trénovací data (až do) |
|---|---|---|---|---|
gpt-5.1 (2025-11-13) |
-
Uvažování – Rozhraní API pro dokončování chatů - Rozhraní API pro odpovědi - Strukturované výstupy. - Zpracování textu a obrázku. – Funkce, nástroje a paralelní volání nástrojů. - Úplný souhrn možností |
400,000 Vstup: 272 000 Výstup: 128 000 |
128,000 | 30. září 2024 |
gpt-5.1-chat (2025-11-13) Náhled |
-
Uvažování – Rozhraní API pro dokončování chatů - Rozhraní API pro odpovědi - Strukturované výstupy – Funkce, nástroje a paralelní volání nástrojů. |
128,000 Vstup: 111 616 Výstup: 16 384 |
16,384 | 30. září 2024 |
gpt-5.1-codex (2025-11-13) |
- Pouze rozhraní API pro odpovědi - Zpracování textu a obrázku - Strukturované výstupy. – Funkce, nástroje a paralelní volání nástrojů. - Úplný souhrn možností - Optimalizované pro rozšíření Codex CLI a Codex VS Code |
400,000 Vstup: 272 000 Výstup: 128 000 |
128,000 | 30. září 2024 |
gpt-5.1-codex-mini (2025-11-13) |
- Pouze rozhraní API pro odpovědi - Zpracování textu a obrázku - Strukturované výstupy. – Funkce, nástroje a paralelní volání nástrojů. - Úplný souhrn možností - Optimalizované pro rozšíření Codex CLI a Codex VS Code |
400,000 Vstup: 272 000 Výstup: 128 000 |
128,000 | 30. září 2024 |
gpt-5.1-codex-max (2025-12-04) |
- Pouze rozhraní API pro odpovědi - Zpracování textu a obrázku - Strukturované výstupy. – Funkce, nástroje a paralelní volání nástrojů. - Úplný souhrn možností - Optimalizované pro rozšíření Codex CLI a Codex VS Code |
400,000 Vstup: 272 000 Výstup: 128 000 |
128,000 | 30. září 2024 |
Pozor
Nedoporučujeme používat modely Preview v produkčním prostředí. Upgradujeme všechna nasazení modelů Preview na budoucí verze Preview nebo na nejnovější stabilní obecně dostupnou verzi. Modely, které jsou určené verze Preview, nedodržují standardní Azure životní cyklus modelu OpenAI.
Důležité
gpt-5.1reasoning_effortse nastavuje nanone. Při upgradu z předchozích modelů uvažování nagpt-5.1mějte na paměti, že možná budete muset aktualizovat kód pro předání úrovněreasoning_effort, pokud chcete, aby k uvažování došlo.gpt-5.1-chatpřidá integrované možnosti odůvodnění. Stejně jako jiné modely odůvodnění nepodporuje parametry jakotemperature. Pokud upgradujete z použitígpt-5-chat(což není důvodový model) nagpt-5.1-chat, ujistěte se, že jste ze svého kódu odebrali všechny vlastní parametry jakotemperature, které nejsou podporovány důvodovými modely.gpt-5.1-codex-maxpřidává podporu pro nastaveníreasoning_effortdoxhighsouboru . Důvodové úsilínonenení podporováno vgpt-5.1-codex-max.
GPT-5
Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.
Schopnosti
| ID modelu | Popis | Kontextové okno | Maximální počet výstupních tokenů | Trénovací data (až do) |
|---|---|---|---|---|
gpt-5 (2025-08-07) |
-
Uvažování – Rozhraní API pro dokončování chatů - Rozhraní API pro odpovědi - Strukturované výstupy. - Zpracování textu a obrázku. – Funkce, nástroje a paralelní volání nástrojů. - Úplný souhrn možností |
400,000 Vstup: 272 000 Výstup: 128 000 |
128,000 | 30. září 2024 |
gpt-5-mini (2025-08-07) |
-
Uvažování – Rozhraní API pro dokončování chatů - Rozhraní API pro odpovědi - Strukturované výstupy. - Zpracování textu a obrázku. – Funkce, nástroje a paralelní volání nástrojů. - Úplný souhrn možností |
400,000 Vstup: 272 000 Výstup: 128 000 |
128,000 | 31. května 2024 |
gpt-5-nano (2025-08-07) |
-
Uvažování – Rozhraní API pro dokončování chatů - Rozhraní API pro odpovědi - Strukturované výstupy. - Zpracování textu a obrázku. – Funkce, nástroje a paralelní volání nástrojů. - Úplný souhrn možností |
400,000 Vstup: 272 000 Výstup: 128 000 |
128,000 | 31. května 2024 |
gpt-5-chat (2025-08-07)Náhled |
– Rozhraní API pro dokončování chatů - Rozhraní API pro odpovědi - Vstup: Text/obrázek - Výstup: Pouze text |
128,000 | 16,384 | 30. září 2024 |
gpt-5-chat (2025-10-03)Preview1 |
– Rozhraní API pro dokončování chatů - Rozhraní API pro odpovědi - Vstup: Text/obrázek - Výstup: Pouze text |
128,000 | 16,384 | 30. září 2024 |
gpt-5-codex (2025-09-11) |
- Pouze rozhraní API pro odpovědi - Vstup: Text/obrázek - Výstup: Pouze text - Strukturované výstupy. - Zpracování textu a obrázku. – Funkce, nástroje a paralelní volání nástrojů. - Úplný souhrn možností - Optimalizované pro rozšíření Codex CLI a Codex VS Code |
400,000 Vstup: 272 000 Výstup: 128 000 |
128,000 | - |
gpt-5-pro (2025-10-06) |
-
Uvažování - Rozhraní API pro odpovědi - Strukturované výstupy. - Zpracování textu a obrázku. - Funkce a nástroje - Úplný souhrn možností |
400,000 Vstup: 272 000 Výstup: 128 000 |
128,000 | 30. září 2024 |
Poznámka
1gpt-5-chat verze 2025-10-03 představuje významné vylepšení zaměřené na emocionální inteligenci a možnosti v oblasti duševního zdraví. Tento upgrade integruje specializované datové sady a upřesňující strategie odezvy, aby se zlepšila schopnost modelu provádět následující akce:
- Pochopit a interpretovat emocionální kontext přesněji, což umožňuje nuantní a empatitické interakce.
- Poskytovat podporu, zodpovědné reakce v konverzacích souvisejících s duševním zdravím, zajištění citlivosti a dodržování osvědčených postupů.
Cílem těchto vylepšení je, aby GPT-5-chat více zohledňoval kontext, byl soustředěný na člověka a spolehlivý ve scénářích, kde je důležitý emoční tón a aspekty pohody.
Pozor
Nedoporučujeme používat modely Preview v produkčním prostředí. Upgradujeme všechna nasazení modelů Preview na budoucí verze Preview nebo na nejnovější stabilní obecně dostupnou verzi. Modely, které jsou určené verze Preview, nedodržují standardní Azure životní cyklus modelu OpenAI.
gpt-oss
Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.
Schopnosti
| ID modelu | Popis | Kontextové okno | Maximální počet výstupních tokenů | Trénovací data (až do) |
|---|---|---|---|---|
gpt-oss-120b
1 (Preview) |
Pouze vstup/výstup textu – API pro dokončování chatových interakcí -Streaming - Volání funkce - Strukturované výstupy -Uvažování – K dispozici pro nasazení1 a přes spravované výpočetní prostředky |
131,072 | 131,072 | 31. května 2024 |
gpt-oss-20b (Preview) |
Pouze vstup/výstup textu – API pro dokončování chatových interakcí -Streaming - Volání funkce - Strukturované výstupy -Uvažování – K dispozici přes spravovaná výpočetní řešení a Foundry Local |
131,072 | 131,072 | 31. května 2024 |
1 Na rozdíl od jiných modelů gpt-oss-120b OpenAI Azure vyžaduje k nasazení modelu projekt Foundry.
Nasazení pomocí kódu
az cognitiveservices account deployment create \
--name "Foundry-project-resource" \
--resource-group "test-rg" \
--deployment-name "gpt-oss-120b" \
--model-name "gpt-oss-120b" \
--model-version "1" \
--model-format "OpenAI-OSS" \
--sku-capacity 10 \
--sku-name "GlobalStandard"
Řada GPT-4.1
Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.
Schopnosti
| ID modelu | Popis | Kontextové okno | Maximální počet výstupních tokenů | Trénovací data (až do) |
|---|---|---|---|---|
gpt-4.1 (2025-04-14) |
- Zadávání textu a obrázku - Textový výstup – Rozhraní API pro dokončování konverzací - Rozhraní API pro odpovědi -Streaming - Volání funkce - Strukturované výstupy (dokončení chatu) |
- 1,047,576 – 300 000 (standardní nasazení) – 128 000 (zřízená spravovaná a dávková nasazení) |
32,768 | 31. května 2024 |
gpt-4.1-nano (2025-04-14) |
- Zadávání textu a obrázku - Textový výstup – Rozhraní API pro dokončování konverzací - Rozhraní API pro odpovědi -Streaming - Volání funkce - Strukturované výstupy (dokončení chatu) |
- 1,047,576 – 300 000 (standardní nasazení) – 128 000 (zřízená spravovaná a dávková nasazení) |
32,768 | 31. května 2024 |
gpt-4.1-mini (2025-04-14) |
- Zadávání textu a obrázku - Textový výstup – Rozhraní API pro dokončování konverzací - Rozhraní API pro odpovědi -Streaming - Volání funkce - Strukturované výstupy (dokončení chatu) |
- 1,047,576 – 300 000 (standardní nasazení) – 128 000 (zřízená spravovaná a dávková nasazení) |
32,768 | 31. května 2024 |
Poznámka
Zřízená spravovaná nasazení modelů řady GPT-4.1 podporují délky kontextu menší než 128 000 tokenů. Požadavek, který tento limit překročí, vrátí chybu HTTP 400. Pokud chcete zpracovávat požadavky s dlouhým kontextem v rámci zřízeného nasazení, povolte spillover, které tyto požadavky směruje na odpovídající standardní nasazení.
Známý problém
Známý problém má vliv na všechny modely řady GPT-4.1. Rozsáhlé definice volání nástrojů nebo funkcí, které přesahují 300 000 tokenů, způsobují selhání, přestože není dosaženo kontextového limitu modelů 1 milion tokenů.
Chyby se mohou lišit v závislosti na vlastnostech volání rozhraní API a základní datové části.
Tady jsou chybové zprávy rozhraní API pro dokončování chatu:
Error code: 400 - {'error': {'message': "This model's maximum context length is 300000 tokens. However, your messages resulted in 350564 tokens (100 in the messages, 350464 in the functions). Please reduce the length of the messages or functions.", 'type': 'invalid_request_error', 'param': 'messages', 'code': 'context_length_exceeded'}}Error code: 400 - {'error': {'message': "Invalid 'tools[0].function.description': string too long. Expected a string with maximum length 1048576, but got a string with length 2778531 instead.", 'type': 'invalid_request_error', 'param': 'tools[0].function.description', 'code': 'string_above_max_length'}}
Tady je chybová zpráva pro rozhraní API pro odpovědi:
Error code: 500 - {'error': {'message': 'The server had an error processing your request. Sorry about that! You can retry your request, or contact us through an Azure support request at: https://go.microsoft.com/fwlink/?linkid=2213926 if you keep seeing this error. (Please include the request ID d2008353-291d-428f-adc1-defb5d9fb109 in your email.)', 'type': 'server_error', 'param': None, 'code': None}}
náhled použití počítače
Experimentální model natrénovaný pro použití s nástrojem Responses API pro práci s počítačem.
Dá se použít s knihovnami třetích stran, aby model mohl ovládat vstup myši a klávesnice a zároveň získat kontext ze snímků obrazovky aktuálního prostředí.
Pozor
Nedoporučujeme používat modely Preview v produkčním prostředí. Upgradujeme všechna nasazení modelů Preview na budoucí verze Preview nebo na nejnovější stabilní obecně dostupnou verzi. Modely, které jsou určené verze Preview, nedodržují standardní Azure životní cyklus modelu OpenAI.
Pro přístup computer-use-previewse vyžaduje registrace . Přístup se uděluje na základě kritérií způsobilosti Microsoft. Zákazníci, kteří mají přístup k jiným modelům omezeného přístupu, stále potřebují požádat o přístup pro tento model.
Pokud chcete požádat o přístup, přejděte do aplikace modelu omezenéhocomputer-use-preview přístupu. Když je udělen přístup, musíte pro model vytvořit nasazení.
Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.
Schopnosti
| ID modelu | Popis | Kontextové okno | Maximální počet výstupních tokenů | Trénovací data (až do) |
|---|---|---|---|---|
computer-use-preview (2025-03-11) |
Specializovaný model pro použití s nástrojem Rozhraní API pro odpovědi pro používání počítače -Nástroje -Streaming - Text (vstup/výstup) - Obrázek (vstup) |
8,192 | 1,024 | Října 2023 |
Modely O-series
Modely o-series od Azure OpenAI jsou navržené tak, aby řešily úlohy logického uvažování a řešení problémů se zvýšenou pozorností a schopnostmi. Tyto modely tráví více času zpracováním a porozuměním požadavku uživatele, což je mimořádně silné v oblastech, jako je věda, kódování a matematika v porovnání s předchozími iteracemi.
Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.
Schopnosti
| ID modelu | Popis | Maximální počet požadavků (tokeny) | Trénovací data (až do) |
|---|---|---|---|
codex-mini (2025-05-16) |
Jemně vyladěná verze o4-mini. - Rozhraní API pro odpovědi - Strukturované výstupy. - Zpracování textu a obrázku. - Funkce a nástroje. Úplný souhrn možností |
Vstup: 200 000 Výstup: 100 000 |
31. května 2024 |
o3-pro (2025-06-10) |
-
Rozhraní API pro odpovědi - Strukturované výstupy. - Zpracování textu a obrázku. - Funkce a nástroje. Úplný souhrn možností |
Vstup: 200 000 Výstup: 100 000 |
31. května 2024 |
o4-mini (2025-04-16) |
-
Nový model zdůvodnění, který nabízí vylepšené schopnosti zdůvodnění. – Rozhraní API pro dokončování chatů - Rozhraní API pro odpovědi - Strukturované výstupy. - Zpracování textu a obrázku. - Funkce a nástroje. Úplný souhrn možností |
Vstup: 200 000 Výstup: 100 000 |
31. května 2024 |
o3 (2025-04-16) |
-
Nový model zdůvodnění, který nabízí vylepšené schopnosti zdůvodnění. – Rozhraní API pro dokončování chatů - Rozhraní API pro odpovědi - Strukturované výstupy. - Zpracování textu a obrázku. – Funkce, nástroje a paralelní volání nástrojů. Úplný souhrn možností |
Vstup: 200 000 Výstup: 100 000 |
31. května 2024 |
o3-mini (2025-01-31) |
-
Vylepšené možnosti odůvodnění. - Strukturované výstupy. - Zpracování pouze textu. - Funkce a nástroje. |
Vstup: 200 000 Výstup: 100 000 |
Října 2023 |
o1 (2024-12-17) |
-
Vylepšené možnosti odůvodnění. - Strukturované výstupy. - Zpracování textu a obrázku. - Funkce a nástroje. |
Vstup: 200 000 Výstup: 100 000 |
Října 2023 |
o1-preview
1 (2024-09-12) |
Starší ukázková verze | Vstup: 128 000 Výstup: 32 768 |
Října 2023 |
o1-mini
2 (12.09.2024) |
Rychlejší a nákladově efektivnější možnost v řadě o1, která je ideální pro úlohy kódování, které vyžadují rychlost a nižší spotřebu prostředků. – Ve výchozím nastavení je k dispozici globální nasazení standardu. – Standardní (regionální) nasazení jsou aktuálně dostupná jenom pro vybrané zákazníky, kteří obdrželi přístup jako součást o1-preview omezené verze přístupu. |
Vstup: 128 000 Výstup: 65 536 |
Října 2023 |
1o1-preview je k dispozici pouze pro zákazníky, kteří získali přístup jako součást původního omezeného přístupu.
2o1-mini je aktuálně k dispozici všem zákazníkům pro globální nasazení standardu. Vybraným zákazníkům byl udělen standardní přístup k nasazení (regionální) o1-mini v rámci uvedení s omezeným přístupem o1-preview. V současné době se přístup ke standardním o1-mini (regionálním) nasazením nerozšiřuje.
o3-deep-research je aktuálně k dispozici pouze se službou Foundry Agent Service. Další informace najdete v doprovodných materiálech k nástroji hloubkového výzkumu.
Další informace o pokročilých modelech o-series najdete v tématu Začínáme s modely zdůvodňování.
GPT-4o a GPT-4 Turbo
GPT-4o integruje text a obrázky do jednoho modelu, který umožňuje zpracovávat více datových typů současně. Tento multimodální přístup zlepšuje přesnost a rychlost odezvy v interakcích lidského počítače. GPT-4o se vyrovná GPT-4 Turbo v úlohách s anglickým textem a programováním a zároveň nabízí lepší výkon v úlohách v jiných než anglických jazycích a ve vizuálních úlohách, stanovením nových standardů pro možnosti AI.
Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.
Modely GPT-4 a GPT-4 Turbo
Tyto modely můžete používat pouze s rozhraním API pro dokončování chatu. Informace o tom, jak Azure OpenAI zpracovává upgrady verzí modelu, najdete v tématu Verze modelu. Informace o zobrazení a konfiguraci nastavení verze modelu nasazení GPT-4 najdete v tématu Práce s modely.
Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.
Schopnosti
| ID modelu | Popis | Maximální počet požadavků (tokeny) | Trénovací data (až do) |
|---|---|---|---|
gpt-4o (2024-11-20) GPT-4o (Omni) |
- Strukturované výstupy. - Zpracování textu a obrázku. – Režim JSON. - Paralelní volání funkcí. - Vyšší přesnost a rychlost odezvy. - Parita s anglickým textem a úkoly v oblasti kódování ve srovnání s GPT-4 Turbo Vision. - Vynikající výkon v neanglických jazycích a v vizuálních úlohách. - Vylepšená schopnost kreativního psaní. |
Vstup: 128 000 Výstup: 16 384 |
Října 2023 |
gpt-4o (2024-08-06) GPT-4o (Omni) |
- Strukturované výstupy. - Zpracování textu a obrázku. – Režim JSON. - Paralelní volání funkcí. - Vyšší přesnost a rychlost odezvy. - Parita s anglickým textem a úkoly v oblasti kódování ve srovnání s GPT-4 Turbo Vision. - Vynikající výkon v neanglických jazycích a v vizuálních úlohách. |
Vstup: 128 000 Výstup: 16 384 |
Října 2023 |
gpt-4o-mini (2024-07-18) GPT-4o mini |
- Rychlý, levný a schopný model ideální pro nahrazení modelů SÉRIE GPT-3.5 Turbo. - Zpracování textu a obrázku. – Režim JSON. - Paralelní volání funkcí. |
Vstup: 128 000 Výstup: 16 384 |
Října 2023 |
gpt-4o (2024-05-13) GPT-4o (Omni) |
- Zpracování textu a obrázku. – Režim JSON. - Paralelní volání funkcí. - Vyšší přesnost a rychlost odezvy. - Parita s anglickým textem a úkoly v oblasti kódování ve srovnání s GPT-4 Turbo Vision. - Vynikající výkon v neanglických jazycích a v vizuálních úlohách. |
Vstup: 128 000 Výstup: 4 096 |
Října 2023 |
gpt-4
1 (turbo-2024-04-09) GPT-4 Turbo s vize |
Nový obecně dostupný model. - Náhrada za všechny předchozí modely GPT-4 Preview ( vision-preview, 1106-Preview, 0125-Preview). - Dostupnost funkcí se v současné době liší v závislosti na metodě vstupu a typu nasazení. |
Vstup: 128 000 Výstup: 4 096 |
Prosinec 2023 |
1 Zřízená verze gpt-4turbo-2024-04-09 je aktuálně omezena pouze na text. Další informace o aktivovaných nasazeních najdete v pokynech pro aktivaci.
Pozor
Nedoporučujeme používat modely Preview v produkčním prostředí. Upgradujeme všechna nasazení modelů Preview na budoucí verze Preview nebo na nejnovější stabilní obecně dostupnou verzi. Modely, které jsou určené verze Preview, nedodržují standardní Azure životní cyklus modelu OpenAI.
Vkládání
text-embedding-3-large je nejnovější a nejschopnější model vkládání. Nelze provádět upgrade mezi vloženými modely. Chcete-li přejít z text-embedding-ada-002 na text-embedding-3-large, musíte vygenerovat nové embeddingy.
text-embedding-3-largetext-embedding-3-smalltext-embedding-ada-002
Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.
Schopnosti
Testování OpenAI ukazují, že modely vkládání jak velké, tak malé třetí generace nabízejí lepší průměrný výkon vícejazyčného vyhledávání ve srovnávacím testu MIRACL. Stále udržují výkon pro anglické úlohy pomocí srovnávacího testu MTEB .
| Srovnávací test hodnocení | text-embedding-ada-002 |
text-embedding-3-small |
text-embedding-3-large |
|---|---|---|---|
| Průměr MIRACL | 31.4 | 44.0 | 54.9 |
| Průměr MTEB | 61.0 | 62.3 | 64.6 |
Modely vkládání třetí generace podporují zmenšení velikosti vkládání pomocí nového dimensions parametru. Větší vkládání jsou obvykle dražší z hlediska výpočetních prostředků, paměti a úložiště. Když můžete upravit počet dimenzí, získáte větší kontrolu nad celkovými náklady a výkonem. Parametr dimensions není podporován ve všech verzích knihovny OpenAI 1.x Python. Pokud chcete tento parametr využít, doporučujeme upgradovat na nejnovější verzi: pip install openai --upgrade.
Srovnávací testy MTEB OpenAI zjistily, že i když jsou rozměry modelu třetí generace sníženy na méně než 1 536 dimenzí text-embedding-ada-002, výkon zůstává mírně lepší.
Tyto modely je možné použít pouze s požadavky Embedding API.
| ID modelu | Maximální počet požadavků (tokeny) | Výstupní dimenze | Trénovací data (až do) |
|---|---|---|---|
text-embedding-ada-002 (verze 2) |
8,192 | 1,536 | Zář 2021 |
text-embedding-ada-002 (verze 1) |
2,046 | 1,536 | Zář 2021 |
text-embedding-3-large |
8,192 | 3,072 | Zář 2021 |
text-embedding-3-small |
8,192 | 1,536 | Zář 2021 |
Poznámka
Při odesílání pole vstupů pro embedování je maximální počet položek v poli na jedno volání embedovacího bodu 2 048.
Modely generování obrázků
Modely generování obrázků generují obrázky z textových výzev, které uživatel poskytuje. Modely generování obrázků zahrnují gpt-image-1, gpt-image-1-mini, gpt-image-1.5a gpt-image-2.
Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.
| ID modelu | Maximální počet požadavků (znaků) |
|---|---|
gpt-image-1 |
4,000 |
gpt-image-1-mini |
4,000 |
gpt-image-1.5 |
4,000 |
Modely generování videa
Sora je model AI z OpenAI, který dokáže vytvářet realistické a imaginativní video scény z textových instrukcí. Sora je v ukázkové verzi.
Modely generování videa zahrnují sora a sora-2.
| ID modelu | Maximální počet požadavků (znaků) |
|---|---|
sora |
4,000 |
Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.
Zvukové modely
Zvukové modely v Azure OpenAI jsou dostupné prostřednictvím rozhraní API realtime, completions a audio API.
Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.
Zvukové modely GPT-4o
Zvukové modely GPT-4o jsou součástí řady modelů GPT-4o a podporují buď konverzační interakce s nízkou latencí, řeč dovnitř, řeč ven, nebo generování zvuku.
Pozor
Nedoporučujeme používat modely Preview v produkčním prostředí. Upgradujeme všechna nasazení modelů Preview na budoucí verze Preview nebo na nejnovější stabilní obecně dostupnou verzi. Modely, které jsou určené verze Preview, nedodržují standardní Azure životní cyklus modelu OpenAI.
Podrobnosti o maximálních tokenech žádostí a trénovacích datech jsou k dispozici v následující tabulce:
| ID modelu | Popis | Maximální počet požadavků (tokeny) | Trénovací data (až do) |
|---|---|---|---|
gpt-4o-mini-audio-preview (2024-12-17)Náhled |
Zvukový model pro generování zvuku a textu | Vstup: 128 000 Výstup: 16 384 |
Září 2023 |
gpt-4o-audio-preview (2024-12-17) |
Zvukový model pro generování zvuku a textu | Vstup: 128 000 Výstup: 16 384 |
Září 2023 |
gpt-4o-realtime-preview (2025-06-03) |
Zvukový model pro zpracování zvuku v reálném čase. | Vstup: 32 000 Výstup: 4 096 |
Října 2023 |
gpt-4o-realtime-preview (2024-12-17) |
Zvukový model pro zpracování zvuku v reálném čase. | Vstup: 16 000 Výstup: 4 096 |
Října 2023 |
gpt-4o-mini-realtime-preview (2024-12-17)Náhled |
Zvukový model pro zpracování zvuku v reálném čase. | Vstup: 128 000 Výstup: 4 096 |
Října 2023 |
gpt-audio(28.08.2025)gpt-audio-mini(06.10.2025) |
Zvukový model pro generování zvuku a textu | Vstup: 128,00 Výstup: 16 384 |
Října 2023 |
gpt-realtime (28.08.2025) (GA)gpt-realtime-mini (2025-10-06)gpt-realtime-mini (2025-12-15) |
Zvukový model pro zpracování zvuku v reálném čase. | Vstup: 32 000 Výstup: 4 096 |
Října 2023 |
gpt-audio-1.5 (2026-02-23) |
Zvukový model pro generování zvuku a textu | Vstup: 128 000 Výstup: 16 384 |
Září 2024 |
gpt-realtime-1.5 (2026-02-23) |
Zvukový model pro zpracování zvuku v reálném čase. | Vstup: 32 000 Výstup: 4 096 |
Září 2024 |
gpt-realtime-translate (2026-05-06) |
Audiomodel pro vícejazyčný překlad v reálném čase s výstupem v podobě přeložené řeči i textu | Vstup: 32 000 Výstup: 4 096 |
Září 2024 |
gpt-realtime-whisper (2026-05-06) |
Zvukový model pro přepis s nízkou latencí v reálném čase | Vstup: 32 000 Výstup: 4 096 |
Září 2024 |
gpt-realtime-2 (2026-05-07) |
Zvukový model pro zpracování zvuku v reálném čase. | Vstup: 32 000 Výstup: 4 096 |
Září 2024 |
gpt-realtime-2.1 (2026-07-07)gpt-realtime-2.1-mini (2026-07-07) |
Zvukové modely pro zpracování zvuku v reálném čase. Menší aktualizace oproti gpt-realtime-2 s vylepšeným zpracováním ticha a šumu. |
Vstup: 32 000 Výstup: 4 096 |
Září 2024 |
Poznámka
gpt-realtime-translate a gpt-realtime-whisper používejte hodinové účtování. Většina ostatních modelů v reálném čase používá vstupní a výstupní ceny založené na tokenech. Aktuální sazby najdete na stránce s cenami Azure OpenAI.
Zvukové API
Zvukové modely prostřednictvím /audio rozhraní API lze použít pro převod řeči na text, překlad a převod textu na řeč.
Modely převodu řeči na text
| ID modelu | Popis | Maximální počet požadavků (velikost zvukového souboru) |
|---|---|---|
whisper |
Model rozpoznávání řeči pro obecné účely | 25 MB |
gpt-4o-transcribe (2025-03-20)Náhled |
Model převodu řeči na text s využitím GPT-4o | 25 MB |
gpt-4o-mini-transcribe (2025-03-20)Náhled |
Model převodu řeči na text s technologií GPT-4o mini. | 25 MB |
gpt-4o-transcribe-diarize (2025-10-15)Náhled |
Model převodu řeči na text s automatickým rozpoznáváním řeči | 25 MB |
gpt-4o-mini-transcribe (2025-12-15)Náhled |
Model převodu řeči na text s automatickým rozpoznáváním řeči Vylepšili jsme přesnost a odolnost přepisu. | 25 MB |
Modely překladu řeči
| ID modelu | Popis | Maximální počet požadavků (velikost zvukového souboru) |
|---|---|---|
whisper |
Model rozpoznávání řeči pro obecné účely | 25 MB |
Modely převodu textu na řeč (Preview)
| ID modelu | Popis |
|---|---|
ttsNáhled |
Model převodu textu na řeč optimalizovaný pro rychlost |
tts-hdNáhled |
Model převodu textu na řeč optimalizovaný pro kvalitu |
gpt-4o-mini-tts (2025-03-20) |
Model převodu textu na řeč s technologií GPT-4o mini. Hlas můžete vést tak, aby mluvil v určitém stylu nebo tónu. |
gpt-4o-mini-tts (2025-12-15) |
Model převodu textu na řeč s technologií GPT-4o mini. Hlas můžete vést tak, aby mluvil v určitém stylu nebo tónu. |
Ladění modelů
Pro vyladění se podporují následující modely:
| ID modelu | Standardní oblasti | Globální | Developer | Metody | Stav | Modalita |
|---|---|---|---|---|---|---|
gpt-4o-mini (2024-07-18) |
USA – středosever Švédsko – střed |
✅ | ✅ | SFT | GA | Text na text |
gpt-4o (2024-08-06) |
Východní USA 2 USA – středosever Švédsko – střed |
✅ | ✅ | SFT, DPO | GA | Text a zpracování obrazu na text |
gpt-4.1 (2025-04-14) |
USA – středosever Švédsko – střed |
✅ | ✅ | SFT, DPO | GA | Text a zpracování obrazu na text |
gpt-4.1-mini (2025-04-14) |
USA – středosever Švédsko – střed |
✅ | ✅ | SFT, DPO | GA | Text na text |
gpt-4.1-nano (2025-04-14) |
USA – středosever Švédsko – střed |
✅ | ✅ | SFT, DPO | GA | Text na text |
o4-mini (2025-04-16) |
Východní USA 2 Švédsko – střed |
✅ | ❌ | RFT | GA | Text na text |
gpt-5 (2025-08-07) |
USA – středosever Švédsko – střed |
✅ | ✅ | RFT | GA* | Text na text |
Ministral-3B (2411) |
Nepodporováno | ✅ | ❌ | SFT | Veřejná ukázka | Text na text |
Qwen-32B |
Nepodporováno | ✅ | ❌ | SFT | Veřejná ukázka | Text na text |
Llama-3.3-70B-Instruct |
Nepodporováno | ✅ | ❌ | SFT | Veřejná ukázka | Text na text |
gpt-oss-20b |
Nepodporováno | ✅ | ❌ | SFT | Veřejná ukázka | Text na text |
* Podpora GPT-5 pro doladění výztuže je obecně dostupná, ale přístup je vrátný a dostupný pouze pozvánkou. Pokud vás zajímá registrace, obraťte se na účet Microsoft tým.
Nebo můžete doladit dříve jemně vyladěný model formátovaný jako base-model.ft-{jobid}.
Poznámka
Opensourcové modely (Ministral-3B, Qwen-32B, Llama-3.3-70B-Instruct, gpt-oss-20b) jsou podporovány pouze u prostředků Foundry a v novém uživatelském rozhraní Foundry.
Poznámka
Globální školení poskytuje cenově dostupné školení na token, ale nenabízí uchovávání dat. Aktuálně jsou prostředky služby Foundry dostupné v následujících oblastech:
- Austrálie – východ
- Brazílie – jih
- Kanada – střed
- Kanada – východ
- USA – východ
- Východ USA 2
- Francie – střed
- Německo – středozápad
- Itálie – sever
- Japonsko – východ (bez podpory zraku)
- Korea – střed
- Střed USA – sever
- Norsko – východ
- Poland Central (bez podpory 4.1-nano)
- Jihovýchodní Asie
- Jižní Afrika – sever
- Střed USA – jih
- Indie – jih
- Španělsko – střed
- Švédsko – střed
- Švýcarsko – západ
- Švýcarsko – sever
- Velká Británie – jih
- Západní Evropa
- USA – západ
- USA – západ 3
Asistenti (Preview)
Pro asistenty potřebujete kombinaci podporovaného modelu a podporované oblasti. Některé nástroje a možnosti vyžadují nejnovější modely. Následující modely jsou k dispozici v rozhraní API asistentů, sadě SDK a Foundry. Následující tabulka je určená pro standardní nasazení. Informace o dostupnosti zřízených jednotek propustnosti najdete v tématu Modely zřízené propustnosti. Uvedené modely a oblasti je možné použít s asistenty v1 i v2. Pokud jsou podporované v následujících oblastech, můžete použít modely Global Standard .
| Oblasti | gpt-4o, 2024-05-13 | gpt-4o, 2024-08-06 | gpt-4o-mini, 2024-07-18 | gpt-4, 0613 | gpt-4, 1106-Předběžná verze | gpt-4, 0125-Ukázka | gpt-4, turbo-2024-04-09 | gpt-4-32k, 0613 | gpt-35-turbo, 0613 | gpt-35-turbo, 1106 | gpt-35-turbo, 0125 | gpt-35-turbo-16k, 0613 |
|---|---|---|---|---|---|---|---|---|---|---|---|---|
| australiaeast | - | - | - | ✅ | ✅ | - | - | ✅ | ✅ | ✅ | ✅ | ✅ |
| eastus | ✅ | ✅ | ✅ | - | - | ✅ | ✅ | - | ✅ | - | ✅ | ✅ |
| eastus2 | ✅ | ✅ | ✅ | - | ✅ | - | ✅ | - | ✅ | - | ✅ | ✅ |
| franciecentral | - | - | - | ✅ | ✅ | - | - | ✅ | ✅ | ✅ | - | ✅ |
| japaneast | - | - | - | - | - | - | - | - | ✅ | - | ✅ | ✅ |
| norwayeast | - | - | - | - | ✅ | - | - | - | - | - | - | - |
| Jižní Indie | - | - | - | - | ✅ | - | - | - | - | ✅ | ✅ | - |
| swedencentral | ✅ | ✅ | ✅ | ✅ | ✅ | - | ✅ | ✅ | ✅ | ✅ | - | ✅ |
| uksouth | - | - | - | - | ✅ | ✅ | - | - | ✅ | ✅ | ✅ | ✅ |
| westus | ✅ | ✅ | ✅ | - | ✅ | - | ✅ | - | - | ✅ | ✅ | - |
| westus3 | ✅ | ✅ | ✅ | - | ✅ | - | ✅ | - | - | - | ✅ | - |
Vyřazení modelu
Nejnovější informace o vyřazení modelu najdete v plánu vyřazení modelu.
Související obsah
Modely Black Forest Labs, které prodává Azure
Modely FLUX (Black Forest Labs) přinášejí nejmodernější generování obrázků do Microsoft Foundry a umožňují generovat a upravovat obrázky ve vysoké kvalitě z textových výzev a referenčních obrázků. Modely FLUX podporují celou řadu funkcí, včetně generování textu na obrázek, úprav více referenčních obrázků a generování a úprav v kontextu.
Tyto modely můžete spouštět prostřednictvím rozhraní API poskytovatele služeb BFL a prostřednictvím images/generations a images/edits endpoints.
Pokud chcete pracovat s modely FLUX v Foundry, přečtěte si téma Deploy a použití modelů FLUX v Microsoft Foundry.
Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.
| Model | Typ a koncový bod rozhraní API | Schopnosti |
|---|---|---|
FLUX.2-flex |
Generování obrázků - Rozhraní API poskytovatele služeb BFL: <resource-name>/providers/blackforestlabs/v1/flux-2-flex |
-
Vstup: text a obrázek (32 000 tokenů a až 10 obrázkůi) - Výstup: Jeden obrázek - Volání nástrojů: Ne - Formáty odpovědí: Obrázek (PNG a JPG) - Klíčové funkce: Jemně odstupňovaný ovládací prvek; podpora více referenčních informací pro až 10 obrázků - Další parametry: guidance: Určuje, jak přesně se výstup řídí výzvou. Minimum: 1,5, maximum: 10, výchozí hodnota: 4,5. Vyšší = bližší dodržení pokynu. steps: Počet kroků odvozování. Maximum: 50, výchozí hodnota: 50. Vyšší = více podrobností, pomalejší. |
FLUX.2-pro |
Generování obrázků - Rozhraní API poskytovatele služeb BFL: <resource-name>/providers/blackforestlabs/v1/flux-2-pro |
-
Vstup: text a obrázek (32 000 tokenů a až 8 obrázkůii) - Výstup: Jeden obrázek - Volání nástrojů: Ne - Formáty odpovědí: Obrázek (PNG a JPG) - Klíčové funkce: Podpora více referencí pro až 8 obrázků; více znalostí z reálného světa; větší flexibilita výstupu; zvýšení výkonu - Další parametry:(Pouze rozhraní API specifické pro zprostředkovatele) Podporuje všechny parametry. |
FLUX.1-Kontext-pro |
Generování obrázků - Rozhraní API pro obrázky: https://<resource-name>/openai/deployments/{deployment-id}/images/generations A https://<resource-name>/openai/deployments/{deployment-id}/images/edits - Rozhraní API poskytovatele služeb BFL: <resource-name>/providers/blackforestlabs/v1/flux-kontext-pro?api-version=preview |
-
Vstup: text a obrázek (5 000 tokenů a 1 obrázek) - Výstup: Jeden obrázek - Volání nástrojů: Ne - Formáty odpovědí: Obrázek (PNG a JPG) - Klíčové funkce: Konzistence znaků, pokročilé úpravy - Další parametry:(Pouze rozhraní API specifické pro zprostředkovatele) seed, aspect ratio, input_image, prompt_unsampling, safety_tolerance, output_format |
FLUX-1.1-pro |
Generování obrázků - Rozhraní API pro obrázky: https://<resource-name>/openai/deployments/{deployment-id}/images/generations - Rozhraní API poskytovatele služeb BFL: <resource-name>/providers/blackforestlabs/v1/flux-pro-1.1?api-version=preview |
-
Vstup: text (5 000 tokenů a 1 obrázek) - Výstup: Jeden obrázek - Volání nástrojů: Ne - Formáty odpovědí: Obrázek (PNG a JPG) - Klíčové funkce: Rychlé odvozování, silná shoda s výzvami, konkurenční ceny, škálovatelné generování - Další parametry:(Pouze rozhraní API specifické pro zprostředkovatele) width, height, prompt_unsampling, seed, safety_tolerance, output_format |
i,ii Podpora více referenčních imagí je k dispozici pro FLUX.2 [pro] (Preview) a FLUX.2 [flex] (Preview) pomocí rozhraní API, ale ne v dětském hřišti.
Modely cohere prodané Azure
Řada modelů Cohere zahrnuje různé modely optimalizované pro různé případy použití, včetně dokončování chatu, přeřazení/klasifikace textu a embeddingů. Modely cohere jsou optimalizované pro různé případy použití, mezi které patří odůvodnění, shrnutí a odpovědi na otázky.
Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.
| Model | Typ | Schopnosti |
|---|---|---|
Cohere-rerank-v4.0-pro |
klasifikace textu (změna pořadí) |
-
Vstup: text - Výstup: text - Jazyky: en, fr, es, it, de, pt-br, ja, zh-cn, ar, vi, hi, ru, a idnl - Volání nástrojů: Ne - Formáty odpovědí: JSON |
Cohere-rerank-v4.0-fast |
klasifikace textu (změna pořadí) |
-
Vstup: text - Výstup: text - Jazyky: en, fr, es, it, de, pt-br, ja, zh-cn, ar, vi, hi, ru, a idnl - Volání nástrojů: Ne - Formáty odpovědí: JSON |
Cohere-command-a-plus-05-2026 Náhled |
dokončení chatu (s odůvodněním obsahu) |
-
Vstup: text (128 000 tokenů) - Výstup: text (64 000 tokenů) - Jazyky: en, fr, es, , itde, pt-brja, , ko, , zh-cnaar - Volání nástrojů: Ano - Formáty odpovědí: Text |
Cohere-command-a |
dokončení chatu |
-
Vstup: text (131 072 tokenů) - Výstup: text (8 182 tokenů) - Jazyky: en, fr, es, , itde, pt-brja, , ko, , zh-cnaar - Volání nástrojů: Ano - Formáty odpovědí: Text, JSON |
embed-v-4-0 |
vkládání |
-
Vstup: text (512 tokenů) a obrázky (2MM pixely) - Výstup: Vektor (256, 512, 1024, 1536 rozměrů) - Jazyky: en, fr, es, , itde, pt-brja, , ko, , zh-cnaar |
Modely DeepSeek prodávané společností Azure
Řada modelů DeepSeek zahrnuje několik zdůvodněných modelů, které excelují při zdůvodňování úkolů pomocí podrobného procesu trénování, jako je jazyk, vědecké odůvodnění a programovací úkoly.
Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.
| Model | Typ | Schopnosti |
|---|---|---|
DeepSeek-V4-Pro |
dokončení chatu (s odůvodněním obsahu) |
-
Vstup: text (1 000 000 tokenů) - Výstup: text (384 000 tokenů) - Jazyky: en A zh - Volání nástrojů: Ne - Formáty odpovědí: Text, JSON |
DeepSeek-V4-Flash |
dokončení chatu (s odůvodněním obsahu) |
-
Vstup: text (1 000 000 tokenů) - Výstup: text (384 000 tokenů) - Jazyky: en A zh - Volání nástrojů: Ne - Formáty odpovědí: Text, JSON |
DeepSeek-V3.2-Speciale |
dokončení chatu (s odůvodněním obsahu) |
-
Vstup: text (128 000 tokenů) - Výstup: text (128 000 tokenů) - Jazyky: en A zh - Volání nástrojů: Ne - Formáty odpovědí: Text, JSON |
DeepSeek-V3.2 |
dokončení chatu (s odůvodněním obsahu) |
-
Vstup: text (128 000 tokenů) - Výstup: text (128 000 tokenů) - Jazyky: en A zh - Volání nástrojů: Ne - Formáty odpovědí: Text, JSON |
Meta modely prodané Azure
Modely a nástroje Meta Llama představují kolekci předem natrénovaných a jemně vyladěných generativních AI modelů pro textové a obrazové zpracování. Meta modely se liší měřítkem a zahrnují:
- Malé jazykové modely (SLM), jako jsou 1B a 3B Base a Instruct modely, pro odvozování na zařízeních a edge zařízeních
- Velké jazykové modely střední kategorie (LLM), jako jsou 7B, 8B a 70B Base a Instruct modely
- Vysoce výkonné modely, jako je Meta Llama 3.1-405B Instruct pro generování syntetických dat a použití destilace.
Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.
| Model | Typ | Schopnosti |
|---|---|---|
Llama-4-Maverick-17B-128E-Instruct-FP8 |
dokončení chatu |
-
Vstup: text a obrázky (tokeny 1M) - Výstup: text (1M tokenů) - Jazyky: ar, en, , fr, de, hiid, itpt, es, tl, , thavi - Volání nástrojů: Ne - Formáty odpovědí: Text |
Llama-3.3-70B-Instruct |
dokončení chatu |
-
Vstup: text (128 000 tokenů) - Výstup: text (8 192 tokenů) - Jazyky: en, de, fr, it, pt, hi, , es, a th - Volání nástrojů: Ne - Formáty odpovědí: Text |
Několik meta modelů je také k dispozici od partnerů a komunity.
Microsoft modely, které prodává Azure
Microsoft modely zahrnují různé skupiny modelů, jako jsou modelový směrovač, modely MAI, modely Phi, modely zdravotní AI a další. K dispozici je také několik Microsoft modelů od partnerů a komunity.
Pokud chcete pracovat s modely obrázků MAI v Foundry, přečtěte si téma Deploy a použití modelů obrázků MAI v Microsoft Foundry.
Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.
| Model | Typ | Schopnosti |
|---|---|---|
MAI-Image-2.5-Flash Náhled |
Z obrazu na obraz a z textu na obraz Podrobnosti najdete v koncových bodech rozhraní API . |
-
Vstup: text, obrázek (formát JPEG nebo PNG pro pracovní postupy úprav obrázků) - Výstup: Jeden obrázek - Délka kontextu: 32 000 tokenů - Volání nástrojů: Ne - Formáty odpovědí: Obrázek (PNG) - Jazyky: en - Klíčové funkce: Generování vysoce kvalitního textu na image; Úpravy obrázků, které podporují přesné, chirurgické úpravy bez narušení zbytku obrázku; Schopnost generovat realistické obrázky s konzistentní vizuální strukturou. Vhodné pro úlohy, jako je vizualizace konceptu, generování kreativního obsahu, pracovní postupy úprav obrázků a návrh produkčního prostředí. - Parametry: width, height, prompt Minimálně 768×768 pixelů; maximální celkový počet pixelů 1 048 576 (ekvivalent 1024×1024). Obě rozměry mohou překročit 1024, pokud celkový počet pixelů zůstane v rámci limitu (například 768×1365 je platná velikost). |
MAI-Image-2.5 Náhled |
Z obrazu na obraz a z textu na obraz Podrobnosti najdete v koncových bodech rozhraní API . |
-
Vstup: text, obrázek (formát JPEG nebo PNG pro pracovní postupy úprav obrázků) - Výstup: Jeden obrázek - Délka kontextu: 32 000 tokenů - Volání nástrojů: Ne - Formáty odpovědí: Obrázek (PNG) - Jazyky: en - Klíčové funkce: Generování vysoce kvalitního textu na image; Úpravy obrázků, které podporují přesné, chirurgické úpravy bez narušení zbytku obrázku; Schopnost generovat realistické obrázky s konzistentní vizuální strukturou. Vhodné pro úlohy, jako je vizualizace konceptu, generování kreativního obsahu, pracovní postupy úprav obrázků a návrh produkčního prostředí. - Parametry: width, height, prompt Minimálně 768×768 pixelů; maximální celkový počet pixelů 1 048 576 (ekvivalent 1024×1024). Obě rozměry mohou překročit 1024, pokud celkový počet pixelů zůstane v rámci limitu (například 768×1365 je platná velikost). |
model-router
1 |
dokončení chatu | Další podrobnosti najdete v přehledu modelu směrovače. - Vstup: text, obrázek - Výstup: text (maximální počet výstupních tokenů se liší2) Kontextové okno: 200 0003 - Jazyky: en |
1Modelová verze směrovače2025-11-18.
2Maximální počet výstupních tokenů se u podkladových modelů ve směrovači modelu liší. Například 32 768 (GPT-4.1 series), 100 000 (o4-mini), 128 000 (gpt-5 reasoning models) a 16 384 (gpt-5-chat).
3 Větší kontextová okna jsou kompatibilní s některými podkladovými modely směrovače modelů. To znamená, že volání rozhraní API s větším kontextem proběhne úspěšně pouze v případě, že se výzva přesměruje na jeden z těchto modelů. Jinak volání selže.
Modely Mistral prodávané službou Azure
Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.
| Model | Typ | Schopnosti |
|---|---|---|
mistral-document-ai-2512 |
Převod obrázku na text |
-
Vstup: obrázek nebo stránky PDF (30 stránek, max. 30 MB PDF soubor) - Výstup: text - Jazyky: en - Volání nástrojů: ne - Formáty odpovědí: Text, JSON, Markdown |
mistral-medium-3-5 Náhled |
dokončení chatu |
-
Vstup: text (128 000 tokenů), obrázek - Výstup: text (128 000 tokenů) - Volání nástrojů: Ne - Formáty odpovědí: Text, JSON |
mistral-ocr-4-0 Náhled |
Převod obrázku na text |
-
Vstup: obrázek nebo stránky PDF (30 stránek, max. 30 MB PDF soubor) - Výstup: text - Jazyky: en - Volání nástrojů: ne - Formáty odpovědí: Text, JSON, Markdown |
Mistral-Large-3 |
dokončení chatu |
-
Vstup: text, obrázek - Výstup: text - Jazyky: en, fr, , de, es, itptnlzh, a jakoar - Volání nástrojů: Ano - Formáty odpovědí: Text, JSON |
Několik modelů Mistral jsou k dispozici také od partnerů a komunity.
Modely AI Moonshot, které prodává Azure
Modely Moonshot AI zahrnují Kimi K2.6 (Preview) a Kimi K2.5 (Preview), multimodální modely odůvodnění, které přijímají text a vstup obrázku.
Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.
| Model | Typ | Schopnosti |
|---|---|---|
Kimi-K2.7-Code Náhled |
dokončení chatu (s odůvodněním obsahu) |
-
Vstup: text a obrázek (262 144 tokenů) - Výstup: text (262 144 tokenů) - Jazyky: en A zh - Volání nástrojů: Ano - Formáty odpovědí: Text |
Kimi-K2.6 Náhled |
dokončení chatu (s odůvodněním obsahu) |
-
Vstup: text a obrázek (262 144 tokenů) - Výstup: text (262 144 tokenů) - Jazyky: en A zh - Volání nástrojů: Ano - Formáty odpovědí: Text |
Kimi-K2.5 Náhled |
dokončení chatu (s odůvodněním obsahu) |
-
Vstup: text a obrázek (262 144 tokenů) - Výstup: text (262 144 tokenů) - Jazyky: en A zh - Volání nástrojů: Ano - Formáty odpovědí: Text |
Podívejte se na tuto kolekci modelů na portálu Foundry.
Modely xAI prodávané Azure
Modely Grok od xAI ve Foundry Models zahrnují různorodou sadu modelů založených na uvažování i modelů bez uvažování, které jsou určeny pro podnikové případy použití, jako je extrakce dat, programování, shrnutí textu a agentní aplikace.
Pro přístup kgrok-code-fast-1 (Preview) a grok-4.
Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.
| Model | Typ | Schopnosti |
|---|---|---|
grok-4.3 Náhled |
dokončení chatu |
-
Vstup: text (200 000 tokenů) - Výstup: text (8 192 tokenů) - Jazyky: en - Volání nástrojů: ano - Formáty odpovědí: text |
grok-4-20-reasoning Náhled |
dokončení chatu |
-
Vstup: text (262 000 tokenů) - Výstup: text (8 192 tokenů) - Jazyky: en - Volání nástrojů: ano - Formáty odpovědí: text |
grok-4-20-non-reasoning Náhled |
dokončení chatu |
-
Vstup: text (262 000 tokenů) - Výstup: text (8 192 tokenů) - Jazyky: en - Volání nástrojů: ano - Formáty odpovědí: text |
grok-4.1-fast-reasoning |
dokončení chatu |
-
Vstup: text, obrázek (128 000 tokenů) - Výstup: text (128 000 tokenů) - Jazyky: en - Volání nástrojů: ano - Formáty odpovědí: text |
grok-4.1-fast-non-reasoning |
dokončení chatu |
-
Vstup: text, obrázek (128 000 tokenů) - Výstup: text (128 000 tokenů) - Jazyky: en - Volání nástrojů: ano - Formáty odpovědí: text |
grok-4 |
dokončení chatu |
-
Vstup: text (262 000 tokenů) - Výstup: text (8 192 tokenů) - Jazyky: en - Volání nástrojů: ano - Formáty odpovědí: text |
grok-code-fast-1 |
dokončení chatu |
-
Vstup: text (256 000 tokenů) - Výstup: text (8 192 tokenů) - Jazyky: en - Volání nástrojů: ano - Formáty odpovědí: text |