Modely Foundry prodávané Azurem

Microsoft Foundry Models v katalogu modelů tvoří dvě hlavní kategorie, konkrétně Foundry Models prodané Azure a Foundry Models od partnerů a komunity. Tento článek uvádí výběr modelů Foundry prodaných Azure spolu s jejich schopnostmi, typy nasazení a oblastmi dostupnosti, s výjimkou zastaralých a vyřazených modelů. Modely Foundry prodané Azure se také označují jako Direct from Azure Models nebo Azure Direct Models.

Modely prodávané společností Azure jsou také hostovány a provozovány společností Azure jako součást služby Foundry Models. Zahrnují všechny modely OpenAI Azure a konkrétní modely vybrané od hlavních poskytovatelů. Tyto modely se účtují prostřednictvím vašeho předplatného Azure, na které se vztahují smlouvy o úrovni služeb Azure a podporované Microsoft. Pokud chcete zobrazit seznam modelů Foundry podporovaných službou Foundry Agent Service, podívejte se na modely podporované službou Agent Service a seznam modelů Foundry od partnerů najdete v tématu Modely Foundry od partnerů a komunity.

Tip

Pomocí karet v horní části této stránky můžete přepínat mezi Azure modely OpenAI a Other model collections od poskytovatelů, jako jsou Cohere, DeepSeek, Meta, Mistral AI a xAI.

Azure OpenAI v modelech Microsoft Foundry

Azure OpenAI využívá různorodou sadu modelů s různými možnostmi a cenovými body. Dostupnost modelu se liší podle oblastí a cloudu.

Zvýraznění modelu

Modely Popis
Řada GPT-5.6 NEWgpt-5.6-sol, , gpt-5.6-terragpt-5.6-lunaPreview
GPT-chat-latest (Preview) NOVÉgpt-chat-latestNáhled
Řada GPT-5.5 NOVÉgpt-5.5
Řada GPT-5.4 gpt-5.4-mini, gpt-5.4-nano, , gpt-5.4gpt-5.4-pro
Řada GPT-5.3 gpt-5.3-chat, gpt-5.3-codex
Řada GPT-5.2 gpt-5.2-codex, , gpt-5.2gpt-5.2-chatPreview
Řada GPT-5.1 gpt-5.1, gpt-5.1-chatPreview, gpt-5.1-codex, gpt-5.1-codex-mini
Sora NOVÝ sora-2
Řada GPT-5 gpt-5, , gpt-5-mini, gpt-5-nanogpt-5-chatPreview
gpt-oss modely pro usuzování s otevřenými váhami
codex-mini Jemně vyladěná verze o4-mini.
Řada GPT-4.1 gpt-4.1, gpt-4.1-mini, gpt-4.1-nano
náhled pro použití počítače Experimentální model natrénovaný pro použití s nástrojem rozhraní API Responses.
Modely o-series Modely uvažování s pokročilým řešením problémů, zvýšeným zaměřením a schopnostmi.
GPT-4o, GPT-4o mini a GPT-4 Turbo Schopné Azure modely OpenAI s vícemodálními verzemi, které můžou jako vstup přijímat text i obrázky.
Vkládání Sada modelů, které mohou převést text do číselné vektorové formy, aby se usnadnila podobnost textu.
Generování obrázků Řada modelů, které můžou generovat původní obrázky z přirozeného jazyka.
Video generation Model, který může generovat původní video scény z textových instrukcí.
Audio Řada modelů pro převod řeči na text, překlad a převod textu na řeč. Zvukové modely GPT-4o podporují buď konverzační interakce s nízkou latencí se vstupem i výstupem řeči, nebo generování audia.

GPT-chat-nejnovější

Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.

Schopnosti

ID modelu Popis Kontextové okno Maximální počet výstupních tokenů Trénovací data (až do)
gpt-chat-latest (2026-06-24)
Náhled
- Uvažování
– Rozhraní API pro dokončování chatů
- Rozhraní API pro odpovědi
- Strukturované výstupy
– Funkce, nástroje a paralelní volání nástrojů.
128,000

Vstup: 111 616
Výstup: 16 384
16,384 Srpen 2025
gpt-chat-latest (2026-05-28)
Náhled
- Uvažování
– Rozhraní API pro dokončování chatů
- Rozhraní API pro odpovědi
- Strukturované výstupy
– Funkce, nástroje a paralelní volání nástrojů.
128,000

Vstup: 111 616
Výstup: 16 384
16,384 Srpen 2025
gpt-chat-latest (2026-05-05)
Náhled
- Uvažování
– Rozhraní API pro dokončování chatů
- Rozhraní API pro odpovědi
- Strukturované výstupy
– Funkce, nástroje a paralelní volání nástrojů.
128,000

Vstup: 111 616
Výstup: 16 384
16,384 Srpen 2025

Poznámka

Tento model se také může zobrazit podle OpenAI jako GPT-5.5 Instant nebo v rozhraní OpenAI API jako chat-latest. V Microsoft Foundry je název produktu pro tuto verzi gpt-chat-latest. Model nadále sleduje stávající životní cyklus verze Preview a standardní období oznámení. Tým také vyhodnocuje způsoby zjednodušení přístupu zákazníků k nepřetržitě aktualizovaným modelům v průběhu času, ale současné chování zůstává beze změny, protože tato práce pokračuje.

GPT-5.6

Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.

Důležité

V rámci postupného zavedení se přístup k modelům řady GPT-5.6 postupně rozšiřuje na zákazníky. Microsoft sdílí aktualizace, protože onboarduje více zákazníků.

Schopnosti

ID modelu Popis Kontextové okno Maximální počet výstupních tokenů Trénovací data (až do)
gpt-5.6-sol (2026-07-09) - Uvažování
- Rozhraní API pro odpovědi
– Rozhraní API pro dokončování chatů
- Strukturované výstupy.
- Zpracování textu a obrázku.
– Funkce, nástroje a paralelní volání nástrojů.
- Použití počítače
- Úplný souhrn možností
1,050,000

Vstup: 922 000
Výstup: 128 000
128,000 Červen 2026
gpt-5.6-terra (2026-07-09) - Uvažování
- Rozhraní API pro odpovědi
– Rozhraní API pro dokončování chatů
- Strukturované výstupy.
- Zpracování textu a obrázku.
– Funkce, nástroje a paralelní volání nástrojů.
- Použití počítače
- Úplný souhrn možností
1,050,000

Vstup: 922 000
Výstup: 128 000
128,000 Červen 2026
gpt-5.6-luna (2026-07-09) - Uvažování
- Rozhraní API pro odpovědi
– Rozhraní API pro dokončování chatů
- Strukturované výstupy.
- Zpracování textu a obrázku.
– Funkce, nástroje a paralelní volání nástrojů.
- Použití počítače
- Úplný souhrn možností
1,050,000

Vstup: 922 000
Výstup: 128 000
128,000 Červen 2026

GPT-5.5

Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.

Schopnosti

ID modelu Popis Kontextové okno Maximální počet výstupních tokenů Trénovací data (až do)
gpt-5.5 (2026-04-24) - Uvažování
- Rozhraní API pro odpovědi
– Rozhraní API pro dokončování chatů
- Strukturované výstupy.
- Zpracování textu a obrázku.
– Funkce, nástroje a paralelní volání nástrojů.
- Použití počítače
- Úplný souhrn možností
1,050,000

Vstup: 922 000
Výstup: 128 000
128,000 Prosinec 2025

Poznámka

Některé úrovně kvót budou vyžadovat žádosti o kvóty, gpt-5.5 aby bylo možné tento model nasadit. Předplatná vrstvy 5 a vrstvy 6 mají ve výchozím nastavení kvótu.

GPT-5.4

Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.

Schopnosti

ID modelu Popis Kontextové okno Maximální počet výstupních tokenů Trénovací data (až do)
gpt-5.4 (2026-03-05) - Uvažování
- Rozhraní API pro odpovědi
– Rozhraní API pro dokončování chatů
- Strukturované výstupy.
- Zpracování textu a obrázku.
– Funkce, nástroje a paralelní volání nástrojů.
- Použití počítače
- Úplný souhrn možností
1,050,000

Vstup: 922 000
Výstup: 128 000
128,000 Srpen 2025
gpt-5.4-pro (2026-03-05) - Uvažování
- Rozhraní API pro odpovědi
- Zpracování textu a obrázku.
- Funkce a nástroje
- Úplný souhrn možností
1,050,000

Vstup: 922 000
Výstup: 128 000
128,000 Srpen 2025
gpt-5.4-mini (2026-03-17) - Uvažování
- Rozhraní API pro odpovědi
– Rozhraní API pro dokončování chatů
- Strukturované výstupy.
- Zpracování textu a obrázku.
– Funkce, nástroje a paralelní volání nástrojů.
- Použití počítače
- Úplný souhrn možností
400,000

Vstup: 272 000
Výstup: 128 000
128,000 Srpen 2025
gpt-5.4-nano (2026-03-17) - Uvažování
- Rozhraní API pro odpovědi
– Rozhraní API pro dokončování chatů
- Strukturované výstupy.
- Zpracování textu a obrázku.
– Funkce, nástroje a paralelní volání nástrojů.
- Úplný souhrn možností
400,000

Vstup: 272 000
Výstup: 128 000
128,000 Srpen 2025

GPT-5.3

Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.

Schopnosti

ID modelu Popis Kontextové okno Maximální počet výstupních tokenů Trénovací data (až do)
gpt-5.3-codex (2026-02-24) - Uvažování
- Rozhraní API pro odpovědi
- Strukturované výstupy.
- Zpracování textu a obrázku.
– Funkce, nástroje a paralelní volání nástrojů.
- Úplný souhrn možností
- Optimalizované pro rozšíření Codex CLI a Codex VS Code
400,000

Vstup: 272 000
Výstup: 128 000
128,000 Srpen 2025
gpt-5.3-chat (2026-03-03)
Náhled
– Rozhraní API pro dokončování chatů
- Rozhraní API pro odpovědi
- Strukturované výstupy
– Funkce, nástroje a paralelní volání nástrojů.
128,000

Vstup: 111 616
Výstup: 16 384
16,384 Srpen 2025

GPT-5.2

Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.

Schopnosti

ID modelu Popis Kontextové okno Maximální počet výstupních tokenů Trénovací data (až do)
gpt-5.2-codex (2026-01-14) - Uvažování
- Rozhraní API pro odpovědi
- Strukturované výstupy.
- Zpracování textu a obrázku.
– Funkce, nástroje a paralelní volání nástrojů.
- Úplný souhrn možností
- Optimalizované pro rozšíření Codex CLI a Codex VS Code
400,000

Vstup: 272 000
Výstup: 128 000
128,000
gpt-5.2 (2025-12-11) - Uvažování
– Rozhraní API pro dokončování chatů
- Rozhraní API pro odpovědi
- Strukturované výstupy.
- Zpracování textu a obrázku.
– Funkce, nástroje a paralelní volání nástrojů.
- Úplný souhrn možností
400,000

Vstup: 272 000
Výstup: 128 000
128,000 Srpen 2025
gpt-5.2-chat (2025-12-11)
Náhled
– Rozhraní API pro dokončování chatů
- Rozhraní API pro odpovědi
- Strukturované výstupy
– Funkce, nástroje a paralelní volání nástrojů.
128,000

Vstup: 111 616
Výstup: 16 384
16,384 Srpen 2025
gpt-5.2-chat (2026-02-10)
Náhled
– Rozhraní API pro dokončování chatů
- Rozhraní API pro odpovědi
- Strukturované výstupy
– Funkce, nástroje a paralelní volání nástrojů.
128,000

Vstup: 111 616
Výstup: 16 384
16,384 Srpen 2025

Pozor

Nedoporučujeme používat modely Preview v produkčním prostředí. Upgradujeme všechna nasazení modelů Preview na budoucí verze Preview nebo na nejnovější stabilní obecně dostupnou verzi. Modely, které jsou určené verze Preview, nedodržují standardní Azure životní cyklus modelu OpenAI.

GPT-5.1

Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.

Schopnosti

ID modelu Popis Kontextové okno Maximální počet výstupních tokenů Trénovací data (až do)
gpt-5.1 (2025-11-13) - Uvažování
– Rozhraní API pro dokončování chatů
- Rozhraní API pro odpovědi
- Strukturované výstupy.
- Zpracování textu a obrázku.
– Funkce, nástroje a paralelní volání nástrojů.
- Úplný souhrn možností
400,000

Vstup: 272 000
Výstup: 128 000
128,000 30. září 2024
gpt-5.1-chat (2025-11-13)
Náhled
- Uvažování
– Rozhraní API pro dokončování chatů
- Rozhraní API pro odpovědi
- Strukturované výstupy
– Funkce, nástroje a paralelní volání nástrojů.
128,000

Vstup: 111 616
Výstup: 16 384
16,384 30. září 2024
gpt-5.1-codex (2025-11-13) - Pouze rozhraní API pro odpovědi
- Zpracování textu a obrázku
- Strukturované výstupy.
– Funkce, nástroje a paralelní volání nástrojů.
- Úplný souhrn možností
- Optimalizované pro rozšíření Codex CLI a Codex VS Code
400,000

Vstup: 272 000
Výstup: 128 000
128,000 30. září 2024
gpt-5.1-codex-mini (2025-11-13) - Pouze rozhraní API pro odpovědi
- Zpracování textu a obrázku
- Strukturované výstupy.
– Funkce, nástroje a paralelní volání nástrojů.
- Úplný souhrn možností
- Optimalizované pro rozšíření Codex CLI a Codex VS Code
400,000

Vstup: 272 000
Výstup: 128 000
128,000 30. září 2024
gpt-5.1-codex-max (2025-12-04) - Pouze rozhraní API pro odpovědi
- Zpracování textu a obrázku
- Strukturované výstupy.
– Funkce, nástroje a paralelní volání nástrojů.
- Úplný souhrn možností
- Optimalizované pro rozšíření Codex CLI a Codex VS Code
400,000

Vstup: 272 000
Výstup: 128 000
128,000 30. září 2024

Pozor

Nedoporučujeme používat modely Preview v produkčním prostředí. Upgradujeme všechna nasazení modelů Preview na budoucí verze Preview nebo na nejnovější stabilní obecně dostupnou verzi. Modely, které jsou určené verze Preview, nedodržují standardní Azure životní cyklus modelu OpenAI.

Důležité

  • gpt-5.1 reasoning_effort se nastavuje na none. Při upgradu z předchozích modelů uvažování na gpt-5.1 mějte na paměti, že možná budete muset aktualizovat kód pro předání úrovně reasoning_effort, pokud chcete, aby k uvažování došlo.

  • gpt-5.1-chat přidá integrované možnosti odůvodnění. Stejně jako jiné modely odůvodnění nepodporuje parametry jako temperature. Pokud upgradujete z použití gpt-5-chat (což není důvodový model) na gpt-5.1-chat, ujistěte se, že jste ze svého kódu odebrali všechny vlastní parametry jako temperature, které nejsou podporovány důvodovými modely.

  • gpt-5.1-codex-max přidává podporu pro nastavení reasoning_effort do xhighsouboru . Důvodové úsilí none není podporováno v gpt-5.1-codex-max.

GPT-5

Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.

Schopnosti

ID modelu Popis Kontextové okno Maximální počet výstupních tokenů Trénovací data (až do)
gpt-5 (2025-08-07) - Uvažování
– Rozhraní API pro dokončování chatů
- Rozhraní API pro odpovědi
- Strukturované výstupy.
- Zpracování textu a obrázku.
– Funkce, nástroje a paralelní volání nástrojů.
- Úplný souhrn možností
400,000

Vstup: 272 000
Výstup: 128 000
128,000 30. září 2024
gpt-5-mini (2025-08-07) - Uvažování
– Rozhraní API pro dokončování chatů
- Rozhraní API pro odpovědi
- Strukturované výstupy.
- Zpracování textu a obrázku.
– Funkce, nástroje a paralelní volání nástrojů.
- Úplný souhrn možností
400,000

Vstup: 272 000
Výstup: 128 000
128,000 31. května 2024
gpt-5-nano (2025-08-07) - Uvažování
– Rozhraní API pro dokončování chatů
- Rozhraní API pro odpovědi
- Strukturované výstupy.
- Zpracování textu a obrázku.
– Funkce, nástroje a paralelní volání nástrojů.
- Úplný souhrn možností
400,000

Vstup: 272 000
Výstup: 128 000
128,000 31. května 2024
gpt-5-chat (2025-08-07)
Náhled
– Rozhraní API pro dokončování chatů
- Rozhraní API pro odpovědi
- Vstup: Text/obrázek
- Výstup: Pouze text
128,000 16,384 30. září 2024
gpt-5-chat (2025-10-03)
Preview1
– Rozhraní API pro dokončování chatů
- Rozhraní API pro odpovědi
- Vstup: Text/obrázek
- Výstup: Pouze text
128,000 16,384 30. září 2024
gpt-5-codex (2025-09-11) - Pouze rozhraní API pro odpovědi
- Vstup: Text/obrázek
- Výstup: Pouze text
- Strukturované výstupy.
- Zpracování textu a obrázku.
– Funkce, nástroje a paralelní volání nástrojů.
- Úplný souhrn možností
- Optimalizované pro rozšíření Codex CLI a Codex VS Code
400,000

Vstup: 272 000
Výstup: 128 000
128,000 -
gpt-5-pro (2025-10-06) - Uvažování
- Rozhraní API pro odpovědi
- Strukturované výstupy.
- Zpracování textu a obrázku.
- Funkce a nástroje
- Úplný souhrn možností
400,000

Vstup: 272 000
Výstup: 128 000
128,000 30. září 2024

Poznámka

1gpt-5-chat verze 2025-10-03 představuje významné vylepšení zaměřené na emocionální inteligenci a možnosti v oblasti duševního zdraví. Tento upgrade integruje specializované datové sady a upřesňující strategie odezvy, aby se zlepšila schopnost modelu provádět následující akce:

  • Pochopit a interpretovat emocionální kontext přesněji, což umožňuje nuantní a empatitické interakce.
  • Poskytovat podporu, zodpovědné reakce v konverzacích souvisejících s duševním zdravím, zajištění citlivosti a dodržování osvědčených postupů.

Cílem těchto vylepšení je, aby GPT-5-chat více zohledňoval kontext, byl soustředěný na člověka a spolehlivý ve scénářích, kde je důležitý emoční tón a aspekty pohody.

Pozor

Nedoporučujeme používat modely Preview v produkčním prostředí. Upgradujeme všechna nasazení modelů Preview na budoucí verze Preview nebo na nejnovější stabilní obecně dostupnou verzi. Modely, které jsou určené verze Preview, nedodržují standardní Azure životní cyklus modelu OpenAI.

gpt-oss

Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.

Schopnosti

ID modelu Popis Kontextové okno Maximální počet výstupních tokenů Trénovací data (až do)
gpt-oss-120b 1 (Preview) Pouze vstup/výstup textu
– API pro dokončování chatových interakcí
-Streaming
- Volání funkce
- Strukturované výstupy
-Uvažování
– K dispozici pro nasazení1 a přes spravované výpočetní prostředky
131,072 131,072 31. května 2024
gpt-oss-20b (Preview) Pouze vstup/výstup textu
– API pro dokončování chatových interakcí
-Streaming
- Volání funkce
- Strukturované výstupy
-Uvažování
– K dispozici přes spravovaná výpočetní řešení a Foundry Local
131,072 131,072 31. května 2024

1 Na rozdíl od jiných modelů gpt-oss-120b OpenAI Azure vyžaduje k nasazení modelu projekt Foundry.

Nasazení pomocí kódu

az cognitiveservices account deployment create \
  --name "Foundry-project-resource" \
  --resource-group "test-rg" \
  --deployment-name "gpt-oss-120b" \
  --model-name "gpt-oss-120b" \
  --model-version "1" \
  --model-format "OpenAI-OSS" \
  --sku-capacity 10 \
  --sku-name "GlobalStandard"

Řada GPT-4.1

Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.

Schopnosti

ID modelu Popis Kontextové okno Maximální počet výstupních tokenů Trénovací data (až do)
gpt-4.1 (2025-04-14) - Zadávání textu a obrázku
- Textový výstup
– Rozhraní API pro dokončování konverzací
- Rozhraní API pro odpovědi
-Streaming
- Volání funkce
- Strukturované výstupy (dokončení chatu)
- 1,047,576
– 300 000 (standardní nasazení)
– 128 000 (zřízená spravovaná a dávková nasazení)
32,768 31. května 2024
gpt-4.1-nano (2025-04-14) - Zadávání textu a obrázku
- Textový výstup
– Rozhraní API pro dokončování konverzací
- Rozhraní API pro odpovědi
-Streaming
- Volání funkce
- Strukturované výstupy (dokončení chatu)
- 1,047,576
– 300 000 (standardní nasazení)
– 128 000 (zřízená spravovaná a dávková nasazení)
32,768 31. května 2024
gpt-4.1-mini (2025-04-14) - Zadávání textu a obrázku
- Textový výstup
– Rozhraní API pro dokončování konverzací
- Rozhraní API pro odpovědi
-Streaming
- Volání funkce
- Strukturované výstupy (dokončení chatu)
- 1,047,576
– 300 000 (standardní nasazení)
– 128 000 (zřízená spravovaná a dávková nasazení)
32,768 31. května 2024

Poznámka

Zřízená spravovaná nasazení modelů řady GPT-4.1 podporují délky kontextu menší než 128 000 tokenů. Požadavek, který tento limit překročí, vrátí chybu HTTP 400. Pokud chcete zpracovávat požadavky s dlouhým kontextem v rámci zřízeného nasazení, povolte spillover, které tyto požadavky směruje na odpovídající standardní nasazení.

Známý problém

Známý problém má vliv na všechny modely řady GPT-4.1. Rozsáhlé definice volání nástrojů nebo funkcí, které přesahují 300 000 tokenů, způsobují selhání, přestože není dosaženo kontextového limitu modelů 1 milion tokenů.

Chyby se mohou lišit v závislosti na vlastnostech volání rozhraní API a základní datové části.

Tady jsou chybové zprávy rozhraní API pro dokončování chatu:

  • Error code: 400 - {'error': {'message': "This model's maximum context length is 300000 tokens. However, your messages resulted in 350564 tokens (100 in the messages, 350464 in the functions). Please reduce the length of the messages or functions.", 'type': 'invalid_request_error', 'param': 'messages', 'code': 'context_length_exceeded'}}

  • Error code: 400 - {'error': {'message': "Invalid 'tools[0].function.description': string too long. Expected a string with maximum length 1048576, but got a string with length 2778531 instead.", 'type': 'invalid_request_error', 'param': 'tools[0].function.description', 'code': 'string_above_max_length'}}

Tady je chybová zpráva pro rozhraní API pro odpovědi:

  • Error code: 500 - {'error': {'message': 'The server had an error processing your request. Sorry about that! You can retry your request, or contact us through an Azure support request at: https://go.microsoft.com/fwlink/?linkid=2213926 if you keep seeing this error. (Please include the request ID d2008353-291d-428f-adc1-defb5d9fb109 in your email.)', 'type': 'server_error', 'param': None, 'code': None}}

náhled použití počítače

Experimentální model natrénovaný pro použití s nástrojem Responses API pro práci s počítačem.

Dá se použít s knihovnami třetích stran, aby model mohl ovládat vstup myši a klávesnice a zároveň získat kontext ze snímků obrazovky aktuálního prostředí.

Pozor

Nedoporučujeme používat modely Preview v produkčním prostředí. Upgradujeme všechna nasazení modelů Preview na budoucí verze Preview nebo na nejnovější stabilní obecně dostupnou verzi. Modely, které jsou určené verze Preview, nedodržují standardní Azure životní cyklus modelu OpenAI.

Pro přístup computer-use-previewse vyžaduje registrace . Přístup se uděluje na základě kritérií způsobilosti Microsoft. Zákazníci, kteří mají přístup k jiným modelům omezeného přístupu, stále potřebují požádat o přístup pro tento model.

Pokud chcete požádat o přístup, přejděte do aplikace modelu omezenéhocomputer-use-preview přístupu. Když je udělen přístup, musíte pro model vytvořit nasazení.

Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.

Schopnosti

ID modelu Popis Kontextové okno Maximální počet výstupních tokenů Trénovací data (až do)
computer-use-preview (2025-03-11) Specializovaný model pro použití s nástrojem Rozhraní API pro odpovědi pro používání počítače

-Nástroje
-Streaming
- Text (vstup/výstup)
- Obrázek (vstup)
8,192 1,024 Října 2023

Modely O-series

Modely o-series od Azure OpenAI jsou navržené tak, aby řešily úlohy logického uvažování a řešení problémů se zvýšenou pozorností a schopnostmi. Tyto modely tráví více času zpracováním a porozuměním požadavku uživatele, což je mimořádně silné v oblastech, jako je věda, kódování a matematika v porovnání s předchozími iteracemi.

Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.

Schopnosti

ID modelu Popis Maximální počet požadavků (tokeny) Trénovací data (až do)
codex-mini (2025-05-16) Jemně vyladěná verze o4-mini.
- Rozhraní API pro odpovědi
- Strukturované výstupy.
- Zpracování textu a obrázku.
- Funkce a nástroje.
Úplný souhrn možností
Vstup: 200 000
Výstup: 100 000
31. května 2024
o3-pro (2025-06-10) - Rozhraní API pro odpovědi
- Strukturované výstupy.
- Zpracování textu a obrázku.
- Funkce a nástroje.
Úplný souhrn možností
Vstup: 200 000
Výstup: 100 000
31. května 2024
o4-mini (2025-04-16) - Nový model zdůvodnění, který nabízí vylepšené schopnosti zdůvodnění.
– Rozhraní API pro dokončování chatů
- Rozhraní API pro odpovědi
- Strukturované výstupy.
- Zpracování textu a obrázku.
- Funkce a nástroje.
Úplný souhrn možností
Vstup: 200 000
Výstup: 100 000
31. května 2024
o3 (2025-04-16) - Nový model zdůvodnění, který nabízí vylepšené schopnosti zdůvodnění.
– Rozhraní API pro dokončování chatů
- Rozhraní API pro odpovědi
- Strukturované výstupy.
- Zpracování textu a obrázku.
– Funkce, nástroje a paralelní volání nástrojů.
Úplný souhrn možností
Vstup: 200 000
Výstup: 100 000
31. května 2024
o3-mini (2025-01-31) - Vylepšené možnosti odůvodnění.
- Strukturované výstupy.
- Zpracování pouze textu.
- Funkce a nástroje.
Vstup: 200 000
Výstup: 100 000
Října 2023
o1 (2024-12-17) - Vylepšené možnosti odůvodnění.
- Strukturované výstupy.
- Zpracování textu a obrázku.
- Funkce a nástroje.
Vstup: 200 000
Výstup: 100 000
Října 2023
o1-preview 1 (2024-09-12) Starší ukázková verze Vstup: 128 000
Výstup: 32 768
Října 2023
o1-mini 2 (12.09.2024) Rychlejší a nákladově efektivnější možnost v řadě o1, která je ideální pro úlohy kódování, které vyžadují rychlost a nižší spotřebu prostředků.
– Ve výchozím nastavení je k dispozici globální nasazení standardu.
– Standardní (regionální) nasazení jsou aktuálně dostupná jenom pro vybrané zákazníky, kteří obdrželi přístup jako součást o1-preview omezené verze přístupu.
Vstup: 128 000
Výstup: 65 536
Října 2023

1o1-preview je k dispozici pouze pro zákazníky, kteří získali přístup jako součást původního omezeného přístupu.

2o1-mini je aktuálně k dispozici všem zákazníkům pro globální nasazení standardu. Vybraným zákazníkům byl udělen standardní přístup k nasazení (regionální) o1-mini v rámci uvedení s omezeným přístupem o1-preview. V současné době se přístup ke standardním o1-mini (regionálním) nasazením nerozšiřuje.

o3-deep-research je aktuálně k dispozici pouze se službou Foundry Agent Service. Další informace najdete v doprovodných materiálech k nástroji hloubkového výzkumu.

Další informace o pokročilých modelech o-series najdete v tématu Začínáme s modely zdůvodňování.

GPT-4o a GPT-4 Turbo

GPT-4o integruje text a obrázky do jednoho modelu, který umožňuje zpracovávat více datových typů současně. Tento multimodální přístup zlepšuje přesnost a rychlost odezvy v interakcích lidského počítače. GPT-4o se vyrovná GPT-4 Turbo v úlohách s anglickým textem a programováním a zároveň nabízí lepší výkon v úlohách v jiných než anglických jazycích a ve vizuálních úlohách, stanovením nových standardů pro možnosti AI.

Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.

Modely GPT-4 a GPT-4 Turbo

Tyto modely můžete používat pouze s rozhraním API pro dokončování chatu. Informace o tom, jak Azure OpenAI zpracovává upgrady verzí modelu, najdete v tématu Verze modelu. Informace o zobrazení a konfiguraci nastavení verze modelu nasazení GPT-4 najdete v tématu Práce s modely.

Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.

Schopnosti

ID modelu Popis Maximální počet požadavků (tokeny) Trénovací data (až do)
gpt-4o (2024-11-20)
GPT-4o (Omni)
- Strukturované výstupy.
- Zpracování textu a obrázku.
– Režim JSON.
- Paralelní volání funkcí.
- Vyšší přesnost a rychlost odezvy.
- Parita s anglickým textem a úkoly v oblasti kódování ve srovnání s GPT-4 Turbo Vision.
- Vynikající výkon v neanglických jazycích a v vizuálních úlohách.
- Vylepšená schopnost kreativního psaní.
Vstup: 128 000
Výstup: 16 384
Října 2023
gpt-4o (2024-08-06)
GPT-4o (Omni)
- Strukturované výstupy.
- Zpracování textu a obrázku.
– Režim JSON.
- Paralelní volání funkcí.
- Vyšší přesnost a rychlost odezvy.
- Parita s anglickým textem a úkoly v oblasti kódování ve srovnání s GPT-4 Turbo Vision.
- Vynikající výkon v neanglických jazycích a v vizuálních úlohách.
Vstup: 128 000
Výstup: 16 384
Října 2023
gpt-4o-mini (2024-07-18)
GPT-4o mini
- Rychlý, levný a schopný model ideální pro nahrazení modelů SÉRIE GPT-3.5 Turbo.
- Zpracování textu a obrázku.
– Režim JSON.
- Paralelní volání funkcí.
Vstup: 128 000
Výstup: 16 384
Října 2023
gpt-4o (2024-05-13)
GPT-4o (Omni)
- Zpracování textu a obrázku.
– Režim JSON.
- Paralelní volání funkcí.
- Vyšší přesnost a rychlost odezvy.
- Parita s anglickým textem a úkoly v oblasti kódování ve srovnání s GPT-4 Turbo Vision.
- Vynikající výkon v neanglických jazycích a v vizuálních úlohách.
Vstup: 128 000
Výstup: 4 096
Října 2023
gpt-4 1 (turbo-2024-04-09)
GPT-4 Turbo s vize
Nový obecně dostupný model.
- Náhrada za všechny předchozí modely GPT-4 Preview (vision-preview, 1106-Preview, 0125-Preview).
- Dostupnost funkcí se v současné době liší v závislosti na metodě vstupu a typu nasazení.
Vstup: 128 000
Výstup: 4 096
Prosinec 2023

1 Zřízená verze gpt-4turbo-2024-04-09 je aktuálně omezena pouze na text. Další informace o aktivovaných nasazeních najdete v pokynech pro aktivaci.

Pozor

Nedoporučujeme používat modely Preview v produkčním prostředí. Upgradujeme všechna nasazení modelů Preview na budoucí verze Preview nebo na nejnovější stabilní obecně dostupnou verzi. Modely, které jsou určené verze Preview, nedodržují standardní Azure životní cyklus modelu OpenAI.

Vkládání

text-embedding-3-large je nejnovější a nejschopnější model vkládání. Nelze provádět upgrade mezi vloženými modely. Chcete-li přejít z text-embedding-ada-002 na text-embedding-3-large, musíte vygenerovat nové embeddingy.

  • text-embedding-3-large
  • text-embedding-3-small
  • text-embedding-ada-002

Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.

Schopnosti

Testování OpenAI ukazují, že modely vkládání jak velké, tak malé třetí generace nabízejí lepší průměrný výkon vícejazyčného vyhledávání ve srovnávacím testu MIRACL. Stále udržují výkon pro anglické úlohy pomocí srovnávacího testu MTEB .

Srovnávací test hodnocení text-embedding-ada-002 text-embedding-3-small text-embedding-3-large
Průměr MIRACL 31.4 44.0 54.9
Průměr MTEB 61.0 62.3 64.6

Modely vkládání třetí generace podporují zmenšení velikosti vkládání pomocí nového dimensions parametru. Větší vkládání jsou obvykle dražší z hlediska výpočetních prostředků, paměti a úložiště. Když můžete upravit počet dimenzí, získáte větší kontrolu nad celkovými náklady a výkonem. Parametr dimensions není podporován ve všech verzích knihovny OpenAI 1.x Python. Pokud chcete tento parametr využít, doporučujeme upgradovat na nejnovější verzi: pip install openai --upgrade.

Srovnávací testy MTEB OpenAI zjistily, že i když jsou rozměry modelu třetí generace sníženy na méně než 1 536 dimenzí text-embedding-ada-002, výkon zůstává mírně lepší.

Tyto modely je možné použít pouze s požadavky Embedding API.

ID modelu Maximální počet požadavků (tokeny) Výstupní dimenze Trénovací data (až do)
text-embedding-ada-002 (verze 2) 8,192 1,536 Zář 2021
text-embedding-ada-002 (verze 1) 2,046 1,536 Zář 2021
text-embedding-3-large 8,192 3,072 Zář 2021
text-embedding-3-small 8,192 1,536 Zář 2021

Poznámka

Při odesílání pole vstupů pro embedování je maximální počet položek v poli na jedno volání embedovacího bodu 2 048.

Modely generování obrázků

Modely generování obrázků generují obrázky z textových výzev, které uživatel poskytuje. Modely generování obrázků zahrnují gpt-image-1, gpt-image-1-mini, gpt-image-1.5a gpt-image-2.

Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.

ID modelu Maximální počet požadavků (znaků)
gpt-image-1 4,000
gpt-image-1-mini 4,000
gpt-image-1.5 4,000

Modely generování videa

Sora je model AI z OpenAI, který dokáže vytvářet realistické a imaginativní video scény z textových instrukcí. Sora je v ukázkové verzi.

Modely generování videa zahrnují sora a sora-2.

ID modelu Maximální počet požadavků (znaků)
sora 4,000

Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.

Zvukové modely

Zvukové modely v Azure OpenAI jsou dostupné prostřednictvím rozhraní API realtime, completions a audio API.

Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.

Zvukové modely GPT-4o

Zvukové modely GPT-4o jsou součástí řady modelů GPT-4o a podporují buď konverzační interakce s nízkou latencí, řeč dovnitř, řeč ven, nebo generování zvuku.

Pozor

Nedoporučujeme používat modely Preview v produkčním prostředí. Upgradujeme všechna nasazení modelů Preview na budoucí verze Preview nebo na nejnovější stabilní obecně dostupnou verzi. Modely, které jsou určené verze Preview, nedodržují standardní Azure životní cyklus modelu OpenAI.

Podrobnosti o maximálních tokenech žádostí a trénovacích datech jsou k dispozici v následující tabulce:

ID modelu Popis Maximální počet požadavků (tokeny) Trénovací data (až do)
gpt-4o-mini-audio-preview (2024-12-17)
Náhled
Zvukový model pro generování zvuku a textu Vstup: 128 000
Výstup: 16 384
Září 2023
gpt-4o-audio-preview (2024-12-17) Zvukový model pro generování zvuku a textu Vstup: 128 000
Výstup: 16 384
Září 2023
gpt-4o-realtime-preview (2025-06-03) Zvukový model pro zpracování zvuku v reálném čase. Vstup: 32 000
Výstup: 4 096
Října 2023
gpt-4o-realtime-preview (2024-12-17) Zvukový model pro zpracování zvuku v reálném čase. Vstup: 16 000
Výstup: 4 096
Října 2023
gpt-4o-mini-realtime-preview (2024-12-17)
Náhled
Zvukový model pro zpracování zvuku v reálném čase. Vstup: 128 000
Výstup: 4 096
Října 2023
gpt-audio(28.08.2025)
gpt-audio-mini(06.10.2025)
Zvukový model pro generování zvuku a textu Vstup: 128,00
Výstup: 16 384
Října 2023
gpt-realtime (28.08.2025) (GA)
gpt-realtime-mini (2025-10-06)
gpt-realtime-mini (2025-12-15)
Zvukový model pro zpracování zvuku v reálném čase. Vstup: 32 000
Výstup: 4 096
Října 2023
gpt-audio-1.5 (2026-02-23) Zvukový model pro generování zvuku a textu Vstup: 128 000
Výstup: 16 384
Září 2024
gpt-realtime-1.5 (2026-02-23) Zvukový model pro zpracování zvuku v reálném čase. Vstup: 32 000
Výstup: 4 096
Září 2024
gpt-realtime-translate (2026-05-06) Audiomodel pro vícejazyčný překlad v reálném čase s výstupem v podobě přeložené řeči i textu Vstup: 32 000
Výstup: 4 096
Září 2024
gpt-realtime-whisper (2026-05-06) Zvukový model pro přepis s nízkou latencí v reálném čase Vstup: 32 000
Výstup: 4 096
Září 2024
gpt-realtime-2 (2026-05-07) Zvukový model pro zpracování zvuku v reálném čase. Vstup: 32 000
Výstup: 4 096
Září 2024
gpt-realtime-2.1 (2026-07-07)
gpt-realtime-2.1-mini (2026-07-07)
Zvukové modely pro zpracování zvuku v reálném čase. Menší aktualizace oproti gpt-realtime-2 s vylepšeným zpracováním ticha a šumu. Vstup: 32 000
Výstup: 4 096
Září 2024

Poznámka

gpt-realtime-translate a gpt-realtime-whisper používejte hodinové účtování. Většina ostatních modelů v reálném čase používá vstupní a výstupní ceny založené na tokenech. Aktuální sazby najdete na stránce s cenami Azure OpenAI.

Zvukové API

Zvukové modely prostřednictvím /audio rozhraní API lze použít pro převod řeči na text, překlad a převod textu na řeč.

Modely převodu řeči na text

ID modelu Popis Maximální počet požadavků (velikost zvukového souboru)
whisper Model rozpoznávání řeči pro obecné účely 25 MB
gpt-4o-transcribe (2025-03-20)
Náhled
Model převodu řeči na text s využitím GPT-4o 25 MB
gpt-4o-mini-transcribe (2025-03-20)
Náhled
Model převodu řeči na text s technologií GPT-4o mini. 25 MB
gpt-4o-transcribe-diarize (2025-10-15)
Náhled
Model převodu řeči na text s automatickým rozpoznáváním řeči 25 MB
gpt-4o-mini-transcribe (2025-12-15)
Náhled
Model převodu řeči na text s automatickým rozpoznáváním řeči Vylepšili jsme přesnost a odolnost přepisu. 25 MB

Modely překladu řeči

ID modelu Popis Maximální počet požadavků (velikost zvukového souboru)
whisper Model rozpoznávání řeči pro obecné účely 25 MB

Modely převodu textu na řeč (Preview)

ID modelu Popis
tts
Náhled
Model převodu textu na řeč optimalizovaný pro rychlost
tts-hd
Náhled
Model převodu textu na řeč optimalizovaný pro kvalitu
gpt-4o-mini-tts (2025-03-20) Model převodu textu na řeč s technologií GPT-4o mini.

Hlas můžete vést tak, aby mluvil v určitém stylu nebo tónu.
gpt-4o-mini-tts (2025-12-15) Model převodu textu na řeč s technologií GPT-4o mini.

Hlas můžete vést tak, aby mluvil v určitém stylu nebo tónu.

Ladění modelů

Pro vyladění se podporují následující modely:

ID modelu Standardní oblasti Globální Developer Metody Stav Modalita
gpt-4o-mini
(2024-07-18)
USA – středosever
Švédsko – střed
SFT GA Text na text
gpt-4o
(2024-08-06)
Východní USA 2
USA – středosever
Švédsko – střed
SFT, DPO GA Text a zpracování obrazu na text
gpt-4.1
(2025-04-14)
USA – středosever
Švédsko – střed
SFT, DPO GA Text a zpracování obrazu na text
gpt-4.1-mini
(2025-04-14)
USA – středosever
Švédsko – střed
SFT, DPO GA Text na text
gpt-4.1-nano (2025-04-14) USA – středosever
Švédsko – střed
SFT, DPO GA Text na text
o4-mini
(2025-04-16)
Východní USA 2
Švédsko – střed
RFT GA Text na text
gpt-5
(2025-08-07)
USA – středosever
Švédsko – střed
RFT GA* Text na text
Ministral-3B
(2411)
Nepodporováno SFT Veřejná ukázka Text na text
Qwen-32B Nepodporováno SFT Veřejná ukázka Text na text
Llama-3.3-70B-Instruct Nepodporováno SFT Veřejná ukázka Text na text
gpt-oss-20b Nepodporováno SFT Veřejná ukázka Text na text

* Podpora GPT-5 pro doladění výztuže je obecně dostupná, ale přístup je vrátný a dostupný pouze pozvánkou. Pokud vás zajímá registrace, obraťte se na účet Microsoft tým.

Nebo můžete doladit dříve jemně vyladěný model formátovaný jako base-model.ft-{jobid}.

Poznámka

Opensourcové modely (Ministral-3B, Qwen-32B, Llama-3.3-70B-Instruct, gpt-oss-20b) jsou podporovány pouze u prostředků Foundry a v novém uživatelském rozhraní Foundry.

Poznámka

Globální školení poskytuje cenově dostupné školení na token, ale nenabízí uchovávání dat. Aktuálně jsou prostředky služby Foundry dostupné v následujících oblastech:

  • Austrálie – východ
  • Brazílie – jih
  • Kanada – střed
  • Kanada – východ
  • USA – východ​
  • Východ USA 2
  • Francie – střed
  • Německo – středozápad
  • Itálie – sever
  • Japonsko – východ (bez podpory zraku)
  • Korea – střed
  • Střed USA – sever
  • Norsko – východ
  • Poland Central (bez podpory 4.1-nano)
  • Jihovýchodní Asie
  • Jižní Afrika – sever
  • Střed USA – jih
  • Indie – jih
  • Španělsko – střed
  • Švédsko – střed
  • Švýcarsko – západ
  • Švýcarsko – sever
  • Velká Británie – jih
  • Západní Evropa
  • USA – západ
  • USA – západ 3

Asistenti (Preview)

Pro asistenty potřebujete kombinaci podporovaného modelu a podporované oblasti. Některé nástroje a možnosti vyžadují nejnovější modely. Následující modely jsou k dispozici v rozhraní API asistentů, sadě SDK a Foundry. Následující tabulka je určená pro standardní nasazení. Informace o dostupnosti zřízených jednotek propustnosti najdete v tématu Modely zřízené propustnosti. Uvedené modely a oblasti je možné použít s asistenty v1 i v2. Pokud jsou podporované v následujících oblastech, můžete použít modely Global Standard .

Oblasti gpt-4o, 2024-05-13 gpt-4o, 2024-08-06 gpt-4o-mini, 2024-07-18 gpt-4, 0613 gpt-4, 1106-Předběžná verze gpt-4, 0125-Ukázka gpt-4, turbo-2024-04-09 gpt-4-32k, 0613 gpt-35-turbo, 0613 gpt-35-turbo, 1106 gpt-35-turbo, 0125 gpt-35-turbo-16k, 0613
australiaeast - - - - -
eastus - - - -
eastus2 - - - -
franciecentral - - - - - -
japaneast - - - - - - - - -
norwayeast - - - - - - - - - - -
Jižní Indie - - - - - - - - -
swedencentral - -
uksouth - - - - - -
westus - - - - -
westus3 - - - - - -

Vyřazení modelu

Nejnovější informace o vyřazení modelu najdete v plánu vyřazení modelu.

Modely Black Forest Labs, které prodává Azure

Modely FLUX (Black Forest Labs) přinášejí nejmodernější generování obrázků do Microsoft Foundry a umožňují generovat a upravovat obrázky ve vysoké kvalitě z textových výzev a referenčních obrázků. Modely FLUX podporují celou řadu funkcí, včetně generování textu na obrázek, úprav více referenčních obrázků a generování a úprav v kontextu.

Tyto modely můžete spouštět prostřednictvím rozhraní API poskytovatele služeb BFL a prostřednictvím images/generations a images/edits endpoints.

Pokud chcete pracovat s modely FLUX v Foundry, přečtěte si téma Deploy a použití modelů FLUX v Microsoft Foundry.

Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.

Model Typ a koncový bod rozhraní API Schopnosti
FLUX.2-flex Generování obrázků
- Rozhraní API poskytovatele služeb BFL: <resource-name>/providers/blackforestlabs/v1/flux-2-flex
- Vstup: text a obrázek (32 000 tokenů a až 10 obrázkůi)
- Výstup: Jeden obrázek
- Volání nástrojů: Ne
- Formáty odpovědí: Obrázek (PNG a JPG)
- Klíčové funkce: Jemně odstupňovaný ovládací prvek; podpora více referenčních informací pro až 10 obrázků
- Další parametry:
guidance: Určuje, jak přesně se výstup řídí výzvou. Minimum: 1,5, maximum: 10, výchozí hodnota: 4,5. Vyšší = bližší dodržení pokynu.
steps: Počet kroků odvozování. Maximum: 50, výchozí hodnota: 50. Vyšší = více podrobností, pomalejší.
FLUX.2-pro Generování obrázků
- Rozhraní API poskytovatele služeb BFL: <resource-name>/providers/blackforestlabs/v1/flux-2-pro
- Vstup: text a obrázek (32 000 tokenů a až 8 obrázkůii)
- Výstup: Jeden obrázek
- Volání nástrojů: Ne
- Formáty odpovědí: Obrázek (PNG a JPG)
- Klíčové funkce: Podpora více referencí pro až 8 obrázků; více znalostí z reálného světa; větší flexibilita výstupu; zvýšení výkonu
- Další parametry:(Pouze rozhraní API specifické pro zprostředkovatele) Podporuje všechny parametry.
FLUX.1-Kontext-pro Generování obrázků
- Rozhraní API pro obrázky: https://<resource-name>/openai/deployments/{deployment-id}/images/generations
A
https://<resource-name>/openai/deployments/{deployment-id}/images/edits

- Rozhraní API poskytovatele služeb BFL: <resource-name>/providers/blackforestlabs/v1/flux-kontext-pro?api-version=preview
- Vstup: text a obrázek (5 000 tokenů a 1 obrázek)
- Výstup: Jeden obrázek
- Volání nástrojů: Ne
- Formáty odpovědí: Obrázek (PNG a JPG)
- Klíčové funkce: Konzistence znaků, pokročilé úpravy
- Další parametry:(Pouze rozhraní API specifické pro zprostředkovatele)seed, aspect ratio, input_image, prompt_unsampling, safety_tolerance, output_format
FLUX-1.1-pro Generování obrázků
- Rozhraní API pro obrázky: https://<resource-name>/openai/deployments/{deployment-id}/images/generations

- Rozhraní API poskytovatele služeb BFL: <resource-name>/providers/blackforestlabs/v1/flux-pro-1.1?api-version=preview
- Vstup: text (5 000 tokenů a 1 obrázek)
- Výstup: Jeden obrázek
- Volání nástrojů: Ne
- Formáty odpovědí: Obrázek (PNG a JPG)
- Klíčové funkce: Rychlé odvozování, silná shoda s výzvami, konkurenční ceny, škálovatelné generování
- Další parametry:(Pouze rozhraní API specifické pro zprostředkovatele)width, height, prompt_unsampling, seed, safety_tolerance, output_format

i,ii Podpora více referenčních imagí je k dispozici pro FLUX.2 [pro] (Preview) a FLUX.2 [flex] (Preview) pomocí rozhraní API, ale ne v dětském hřišti.

Modely cohere prodané Azure

Řada modelů Cohere zahrnuje různé modely optimalizované pro různé případy použití, včetně dokončování chatu, přeřazení/klasifikace textu a embeddingů. Modely cohere jsou optimalizované pro různé případy použití, mezi které patří odůvodnění, shrnutí a odpovědi na otázky.

Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.

Model Typ Schopnosti
Cohere-rerank-v4.0-pro klasifikace textu (změna pořadí) - Vstup: text
- Výstup: text
- Jazyky:en, fr, es, it, de, pt-br, ja, zh-cn, ar, vi, hi, ru, a idnl
- Volání nástrojů: Ne
- Formáty odpovědí: JSON
Cohere-rerank-v4.0-fast klasifikace textu (změna pořadí) - Vstup: text
- Výstup: text
- Jazyky:en, fr, es, it, de, pt-br, ja, zh-cn, ar, vi, hi, ru, a idnl
- Volání nástrojů: Ne
- Formáty odpovědí: JSON
Cohere-command-a-plus-05-2026
Náhled
dokončení chatu
(s odůvodněním obsahu)
- Vstup: text (128 000 tokenů)
- Výstup: text (64 000 tokenů)
- Jazyky:en, fr, es, , itde, pt-brja, , ko, , zh-cnaar
- Volání nástrojů: Ano
- Formáty odpovědí: Text
Cohere-command-a dokončení chatu - Vstup: text (131 072 tokenů)
- Výstup: text (8 182 tokenů)
- Jazyky:en, fr, es, , itde, pt-brja, , ko, , zh-cnaar
- Volání nástrojů: Ano
- Formáty odpovědí: Text, JSON
embed-v-4-0 vkládání - Vstup: text (512 tokenů) a obrázky (2MM pixely)
- Výstup: Vektor (256, 512, 1024, 1536 rozměrů)
- Jazyky:en, fr, es, , itde, pt-brja, , ko, , zh-cnaar

Modely DeepSeek prodávané společností Azure

Řada modelů DeepSeek zahrnuje několik zdůvodněných modelů, které excelují při zdůvodňování úkolů pomocí podrobného procesu trénování, jako je jazyk, vědecké odůvodnění a programovací úkoly.

Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.

Model Typ Schopnosti
DeepSeek-V4-Pro dokončení chatu
(s odůvodněním obsahu)
- Vstup: text (1 000 000 tokenů)
- Výstup: text (384 000 tokenů)
- Jazyky:en A zh
- Volání nástrojů: Ne
- Formáty odpovědí: Text, JSON
DeepSeek-V4-Flash dokončení chatu
(s odůvodněním obsahu)
- Vstup: text (1 000 000 tokenů)
- Výstup: text (384 000 tokenů)
- Jazyky:en A zh
- Volání nástrojů: Ne
- Formáty odpovědí: Text, JSON
DeepSeek-V3.2-Speciale dokončení chatu
(s odůvodněním obsahu)
- Vstup: text (128 000 tokenů)
- Výstup: text (128 000 tokenů)
- Jazyky:en A zh
- Volání nástrojů: Ne
- Formáty odpovědí: Text, JSON
DeepSeek-V3.2 dokončení chatu
(s odůvodněním obsahu)
- Vstup: text (128 000 tokenů)
- Výstup: text (128 000 tokenů)
- Jazyky:en A zh
- Volání nástrojů: Ne
- Formáty odpovědí: Text, JSON

Meta modely prodané Azure

Modely a nástroje Meta Llama představují kolekci předem natrénovaných a jemně vyladěných generativních AI modelů pro textové a obrazové zpracování. Meta modely se liší měřítkem a zahrnují:

  • Malé jazykové modely (SLM), jako jsou 1B a 3B Base a Instruct modely, pro odvozování na zařízeních a edge zařízeních
  • Velké jazykové modely střední kategorie (LLM), jako jsou 7B, 8B a 70B Base a Instruct modely
  • Vysoce výkonné modely, jako je Meta Llama 3.1-405B Instruct pro generování syntetických dat a použití destilace.

Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.

Model Typ Schopnosti
Llama-4-Maverick-17B-128E-Instruct-FP8 dokončení chatu - Vstup: text a obrázky (tokeny 1M)
- Výstup: text (1M tokenů)
- Jazyky:ar, en, , fr, de, hiid, itpt, es, tl, , thavi
- Volání nástrojů: Ne
- Formáty odpovědí: Text
Llama-3.3-70B-Instruct dokončení chatu - Vstup: text (128 000 tokenů)
- Výstup: text (8 192 tokenů)
- Jazyky:en, de, fr, it, pt, hi, , es, a th
- Volání nástrojů: Ne
- Formáty odpovědí: Text

Několik meta modelů je také k dispozici od partnerů a komunity.

Microsoft modely, které prodává Azure

Microsoft modely zahrnují různé skupiny modelů, jako jsou modelový směrovač, modely MAI, modely Phi, modely zdravotní AI a další. K dispozici je také několik Microsoft modelů od partnerů a komunity.

Pokud chcete pracovat s modely obrázků MAI v Foundry, přečtěte si téma Deploy a použití modelů obrázků MAI v Microsoft Foundry.

Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.

Model Typ Schopnosti
MAI-Image-2.5-Flash
Náhled
Z obrazu na obraz a z textu na obraz Podrobnosti najdete v koncových bodech rozhraní API . - Vstup: text, obrázek (formát JPEG nebo PNG pro pracovní postupy úprav obrázků)
- Výstup: Jeden obrázek
- Délka kontextu: 32 000 tokenů
- Volání nástrojů: Ne
- Formáty odpovědí: Obrázek (PNG)
- Jazyky:en
- Klíčové funkce: Generování vysoce kvalitního textu na image; Úpravy obrázků, které podporují přesné, chirurgické úpravy bez narušení zbytku obrázku; Schopnost generovat realistické obrázky s konzistentní vizuální strukturou. Vhodné pro úlohy, jako je vizualizace konceptu, generování kreativního obsahu, pracovní postupy úprav obrázků a návrh produkčního prostředí.
- Parametry:width, height, prompt
Minimálně 768×768 pixelů; maximální celkový počet pixelů 1 048 576 (ekvivalent 1024×1024). Obě rozměry mohou překročit 1024, pokud celkový počet pixelů zůstane v rámci limitu (například 768×1365 je platná velikost).
MAI-Image-2.5
Náhled
Z obrazu na obraz a z textu na obraz Podrobnosti najdete v koncových bodech rozhraní API . - Vstup: text, obrázek (formát JPEG nebo PNG pro pracovní postupy úprav obrázků)
- Výstup: Jeden obrázek
- Délka kontextu: 32 000 tokenů
- Volání nástrojů: Ne
- Formáty odpovědí: Obrázek (PNG)
- Jazyky:en
- Klíčové funkce: Generování vysoce kvalitního textu na image; Úpravy obrázků, které podporují přesné, chirurgické úpravy bez narušení zbytku obrázku; Schopnost generovat realistické obrázky s konzistentní vizuální strukturou. Vhodné pro úlohy, jako je vizualizace konceptu, generování kreativního obsahu, pracovní postupy úprav obrázků a návrh produkčního prostředí.
- Parametry:width, height, prompt
Minimálně 768×768 pixelů; maximální celkový počet pixelů 1 048 576 (ekvivalent 1024×1024). Obě rozměry mohou překročit 1024, pokud celkový počet pixelů zůstane v rámci limitu (například 768×1365 je platná velikost).
model-router 1 dokončení chatu Další podrobnosti najdete v přehledu modelu směrovače.
- Vstup: text, obrázek
- Výstup: text (maximální počet výstupních tokenů se liší2)
Kontextové okno: 200 0003
- Jazyky:en

1Modelová verze směrovače2025-11-18.

2Maximální počet výstupních tokenů se u podkladových modelů ve směrovači modelu liší. Například 32 768 (GPT-4.1 series), 100 000 (o4-mini), 128 000 (gpt-5 reasoning models) a 16 384 (gpt-5-chat).

3 Větší kontextová okna jsou kompatibilní s některými podkladovými modely směrovače modelů. To znamená, že volání rozhraní API s větším kontextem proběhne úspěšně pouze v případě, že se výzva přesměruje na jeden z těchto modelů. Jinak volání selže.

Modely Mistral prodávané službou Azure

Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.

Model Typ Schopnosti
mistral-document-ai-2512 Převod obrázku na text - Vstup: obrázek nebo stránky PDF (30 stránek, max. 30 MB PDF soubor)
- Výstup: text
- Jazyky:en
- Volání nástrojů: ne
- Formáty odpovědí: Text, JSON, Markdown
mistral-medium-3-5
Náhled
dokončení chatu - Vstup: text (128 000 tokenů), obrázek
- Výstup: text (128 000 tokenů)
- Volání nástrojů: Ne
- Formáty odpovědí: Text, JSON
mistral-ocr-4-0
Náhled
Převod obrázku na text - Vstup: obrázek nebo stránky PDF (30 stránek, max. 30 MB PDF soubor)
- Výstup: text
- Jazyky:en
- Volání nástrojů: ne
- Formáty odpovědí: Text, JSON, Markdown
Mistral-Large-3 dokončení chatu - Vstup: text, obrázek
- Výstup: text
- Jazyky:en, fr, , de, es, itptnlzh, a jakoar
- Volání nástrojů: Ano
- Formáty odpovědí: Text, JSON

Několik modelů Mistral jsou k dispozici také od partnerů a komunity.

Modely AI Moonshot, které prodává Azure

Modely Moonshot AI zahrnují Kimi K2.6 (Preview) a Kimi K2.5 (Preview), multimodální modely odůvodnění, které přijímají text a vstup obrázku.

Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.

Model Typ Schopnosti
Kimi-K2.7-Code
Náhled
dokončení chatu
(s odůvodněním obsahu)
- Vstup: text a obrázek (262 144 tokenů)
- Výstup: text (262 144 tokenů)
- Jazyky:en A zh
- Volání nástrojů: Ano
- Formáty odpovědí: Text
Kimi-K2.6
Náhled
dokončení chatu
(s odůvodněním obsahu)
- Vstup: text a obrázek (262 144 tokenů)
- Výstup: text (262 144 tokenů)
- Jazyky:en A zh
- Volání nástrojů: Ano
- Formáty odpovědí: Text
Kimi-K2.5
Náhled
dokončení chatu
(s odůvodněním obsahu)
- Vstup: text a obrázek (262 144 tokenů)
- Výstup: text (262 144 tokenů)
- Jazyky:en A zh
- Volání nástrojů: Ano
- Formáty odpovědí: Text

Podívejte se na tuto kolekci modelů na portálu Foundry.

Modely xAI prodávané Azure

Modely Grok od xAI ve Foundry Models zahrnují různorodou sadu modelů založených na uvažování i modelů bez uvažování, které jsou určeny pro podnikové případy použití, jako je extrakce dat, programování, shrnutí textu a agentní aplikace.

Pro přístup kgrok-code-fast-1 (Preview) a grok-4.

Informace o dostupnosti modelů ve všech regionech, seskupené podle kategorie nasazení, najdete v tématu Dostupnost v jednotlivých regionech pro modely Foundry prodávané prostřednictvím Azure.

Model Typ Schopnosti
grok-4.3
Náhled
dokončení chatu - Vstup: text (200 000 tokenů)
- Výstup: text (8 192 tokenů)
- Jazyky:en
- Volání nástrojů: ano
- Formáty odpovědí: text
grok-4-20-reasoning
Náhled
dokončení chatu - Vstup: text (262 000 tokenů)
- Výstup: text (8 192 tokenů)
- Jazyky:en
- Volání nástrojů: ano
- Formáty odpovědí: text
grok-4-20-non-reasoning
Náhled
dokončení chatu - Vstup: text (262 000 tokenů)
- Výstup: text (8 192 tokenů)
- Jazyky:en
- Volání nástrojů: ano
- Formáty odpovědí: text
grok-4.1-fast-reasoning dokončení chatu - Vstup: text, obrázek (128 000 tokenů)
- Výstup: text (128 000 tokenů)
- Jazyky:en
- Volání nástrojů: ano
- Formáty odpovědí: text
grok-4.1-fast-non-reasoning dokončení chatu - Vstup: text, obrázek (128 000 tokenů)
- Výstup: text (128 000 tokenů)
- Jazyky:en
- Volání nástrojů: ano
- Formáty odpovědí: text
grok-4 dokončení chatu - Vstup: text (262 000 tokenů)
- Výstup: text (8 192 tokenů)
- Jazyky:en
- Volání nástrojů: ano
- Formáty odpovědí: text
grok-code-fast-1 dokončení chatu - Vstup: text (256 000 tokenů)
- Výstup: text (8 192 tokenů)
- Jazyky:en
- Volání nástrojů: ano
- Formáty odpovědí: text