Foundry Models aangeboden door Azure in Azure Government

Dit artikel bevat een selectie van Microsoft Foundry Models die door Azure in Azure Government worden verkocht, samen met hun mogelijkheden en deploymenttypen en beschikbaarheidsregio's.

Modellen die door Azure worden verkocht, bevatten alle Azure OpenAI-modellen die in Azure Government worden aangeboden. Deze modellen worden gefactureerd via uw Azure-abonnement, gedekt door Azure serviceovereenkomsten en ondersteund door Microsoft.

Zie Modellen die door Azure worden verkocht voor meer te weten te komen over de kenmerken van alle Foundry-modellen die door Azure in alle clouds worden verkocht.

Azure OpenAI in Microsoft Foundry-modellen binnen Azure Government

Azure OpenAI wordt mogelijk gemaakt door een diverse set modellen met verschillende mogelijkheden en prijspunten. De beschikbaarheid van modellen in Azure Government verschilt per regio.

Modellen Beschrijving
GPT-5.6 serie NIEUWgpt-5.6-sol, gpt-5.6-terra, gpt-5.6-luna
GPT-5.1 serie gpt-5.1
GPT-4.1 serie gpt-4.1, gpt-4.1-mini
o-serie modellen Redeneringsmodellen met geavanceerde probleemoplossing en meer focus en mogelijkheden.
GPT-4o Geschikt Azure OpenAI-modellen met multimodale versies, die zowel tekst als afbeeldingen als invoer kunnen accepteren.
Embeddings Een set modellen waarmee tekst kan worden omgezet in numerieke vectorvorm om de gelijkenis van tekst te vergemakkelijken.

GPT-5.6

Beschikbaarheid van regio's

Model Regio
gpt-5.6-sol (2026-07-09) Bekijk de modellentabel.
gpt-5.6-terra (2026-07-09) Bekijk de modellentabel.
gpt-5.6-luna (2026-07-09) Bekijk de modellentabel.

Mogelijkheden

Model-ID Beschrijving Contextvenster Maximum aantal uitvoertokens Trainingsgegevens (maximaal)
gpt-5.6-sol (2026-07-09) - Redenering
- Antwoord-API.
- Api voor voltooiing van chat.
- Gestructureerde uitvoer.
- Tekst- en afbeeldingsverwerking.
- Functies, hulpprogramma's en parallelle aanroepen van hulpprogramma's.
- Computergebruik
- Volledig overzicht van de mogelijkheden.
1,050,000

Invoer: 922.000
Uitvoer: 128.000
128,000 Juni 2026
gpt-5.6-terra (2026-07-09) - Redenering
- Antwoord-API.
- Api voor voltooiing van chat.
- Gestructureerde uitvoer.
- Tekst- en afbeeldingsverwerking.
- Functies, hulpprogramma's en parallelle aanroepen van hulpprogramma's.
- Computergebruik
- Volledig overzicht van de mogelijkheden.
1,050,000

Invoer: 922.000
Uitvoer: 128.000
128,000 Juni 2026
gpt-5.6-luna (2026-07-09) - Redenering
- Antwoord-API.
- Api voor voltooiing van chat.
- Gestructureerde uitvoer.
- Tekst- en afbeeldingsverwerking.
- Functies, hulpprogramma's en parallelle aanroepen van hulpprogramma's.
- Computergebruik
- Volledig overzicht van de mogelijkheden.
1,050,000

Invoer: 922.000
Uitvoer: 128.000
128,000 Juni 2026

GPT-5.1

Beschikbaarheid van regio's

Model Regio
gpt-5.1 Bekijk de modellentabel.
Model-ID Beschrijving Contextvenster Maximum aantal uitvoertokens Trainingsgegevens (maximaal)
gpt-5.1 (2025-11-13) - Redenering
- Api voor voltooiing van chat.
- Antwoord-API.
- Gestructureerde uitvoer.
- Tekst- en afbeeldingsverwerking.
- Functies, hulpprogramma's en parallelle aanroepen van hulpprogramma's.
- Volledig overzicht van de mogelijkheden.
400,000

Invoer: 272.000
Uitvoer: 128.000
128,000 30 september 2024

Belangrijk

  • gpt-5.1 reasoning_effort is standaard ingesteld op none. Wanneer u een upgrade uitvoert van eerdere redeneringsmodellen naar gpt-5.1, moet u mogelijk uw code bijwerken om expliciet een reasoning_effort niveau door te geven als u redenering wilt uitvoeren.

GPT-4.1 serie

Beschikbaarheid van regio's

Model Regio
gpt-4.1 (2025-04-14) Bekijk de modellentabel.
gpt-4.1-mini (2025-04-14) Bekijk de modellentabel.

Mogelijkheden

Belangrijk

Een bekend probleem heeft invloed op alle GPT 4.1-seriemodellen. Grote hulpprogramma- of functie-aanroepdefinities die meer dan 300.000 tokens overschrijden, leiden tot fouten, ook al is de limiet van 1 miljoen tokencontexten van de modellen niet bereikt.

De fouten kunnen variëren op basis van de API-oproep en de kenmerken van de onderliggende payload.

Hier volgen de foutberichten voor de API voor chatvoltooiingen:

  • Error code: 400 - {'error': {'message': "This model's maximum context length is 300000 tokens. However, your messages resulted in 350564 tokens (100 in the messages, 350464 in the functions). Please reduce the length of the messages or functions.", 'type': 'invalid_request_error', 'param': 'messages', 'code': 'context_length_exceeded'}}

  • Error code: 400 - {'error': {'message': "Invalid 'tools[0].function.description': string too long. Expected a string with maximum length 1048576, but got a string with length 2778531 instead.", 'type': 'invalid_request_error', 'param': 'tools[0].function.description', 'code': 'string_above_max_length'}}

Dit is het foutbericht voor de Antwoorden-API:

  • Error code: 500 - {'error': {'message': 'The server had an error processing your request. Sorry about that! You can retry your request, or contact us through an Azure support request at: https://go.microsoft.com/fwlink/?linkid=2213926 if you keep seeing this error. (Please include the request ID d2008353-291d-428f-adc1-defb5d9fb109 in your email.)', 'type': 'server_error', 'param': None, 'code': None}}
Model-ID Beschrijving Contextvenster Maximum aantal uitvoertokens Trainingsgegevens (tot en met)
gpt-4.1 (2025-04-14) - Invoer van tekst en afbeelding
- Tekstuitvoer
- API voor voltooiing van chat
- Antwoord-API
-Streaming
- Functie-aanroepen
- Gestructureerde uitvoer (chatvoltooiingen)
- 1.047.576 (niet beschikbaar)
- 128.000 (standaard en ingestelde beheerde implementaties)
- 300.000 (batchimplementaties)
32,768 31 mei 2024
gpt-4.1-mini (2025-04-14) - Invoer van tekst en afbeelding
- Tekstuitvoer
- API voor voltooiing van chat
- Antwoord-API
-Streaming
- Functie-aanroepen
- Gestructureerde uitvoer (chatvoltooiingen)
- 1.047.576 (niet beschikbaar)
- 128.000 (standaard en ingestelde beheerde implementaties)
- 300.000 (batchimplementaties)
32,768 31 mei 2024

o-serie modellen

De Azure OpenAI o-serie modellen zijn ontworpen om redeneringen en probleemoplossingstaken aan te pakken met meer focus en mogelijkheden. Deze modellen besteden meer tijd aan het verwerken en begrijpen van de aanvraag van de gebruiker, waardoor ze uitzonderlijk sterk zijn op gebieden zoals wetenschap, codering en wiskunde, vergeleken met eerdere iteraties.

Model-ID Beschrijving Maximum aantal aanvragen (tokens) Trainingsgegevens (tot en met)
o3-mini (2025-01-31) - Verbeterde redeneringsmogelijkheden.
- Gestructureerde uitvoer.
- Alleen tekstverwerking.
- Functies en hulpprogramma's.
Invoer: 200.000
Uitvoer: 100.000
Oktober 2023

Zie Aan de slag met redeneringsmodellen voor meer informatie over geavanceerde o-seriemodellen.

Beschikbaarheid van regio's

Model Regio
o3-mini Bekijk de modellentabel.

GPT-4o

GPT-4o integreert tekst en afbeeldingen in één model, waardoor het meerdere gegevenstypen tegelijk kan verwerken. Deze multimodale benadering verbetert de nauwkeurigheid en reactiesnelheid in interacties tussen menselijke computers. GPT-4o komt overeen met GPT-4 Turbo in het Engels tekst- en coderingstaken en biedt superieure prestaties in niet-Engelse taaltaken en visietaken, waardoor nieuwe benchmarks voor AI-mogelijkheden worden ingesteld.

Model-ID Beschrijving Maximum aantal aanvragen (tokens) Trainingsgegevens (tot en met)
gpt-4o (2024-11-20)
GPT-4o (Omni)
- Gestructureerde uitvoer.
- Tekst- en afbeeldingsverwerking.
- JSON-modus.
- Parallelle functie aanroepen.
- Verbeterde nauwkeurigheid en reactiesnelheid.
- Pariteit met Engelse tekst- en coderingstaken vergeleken met GPT-4 Turbo met Vision.
- Uitstekende prestaties voor niet-Engelstalige talen en bij visuele taken.
- Verbeterde creatieve schrijfvaardigheid.
Invoer: 128.000
Uitvoer: 16.384
Oktober 2023

Insluitingen

text-embedding-3-large is het meest recente en meest geschikte insluitmodel. U kunt geen upgrade uitvoeren tussen insluitingsmodellen. Als u wilt overstappen van gebruik text-embedding-ada-002 naar text-embedding-3-large, moet u nieuwe insluitingen genereren.

  • text-embedding-3-large
  • text-embedding-3-small
  • text-embedding-ada-002

OpenAI meldt dat tests laten zien dat zowel de grote als de kleine derde generatie embeddingmodellen met de MIRACL-benchmark betere gemiddelde meertalige opvraagprestaties bieden. Ze onderhouden nog steeds prestaties voor Engelse taken met de MTEB-benchmark .

Evaluatiecriteria text-embedding-ada-002 text-embedding-3-small text-embedding-3-large
MIRACL-gemiddelde 31.4 44.0 54.9
MTEB-gemiddelde 61.0 62.3 64.6

De insluitingsmodellen van de derde generatie ondersteunen het verminderen van de grootte van het insluiten via een nieuwe dimensions parameter. Meestal zijn grotere insluitingen duurder vanuit het perspectief van rekenkracht, geheugen en opslag. Wanneer u het aantal dimensies kunt aanpassen, krijgt u meer controle over de totale kosten en prestaties. De parameter dimensions wordt niet ondersteund in alle versies van de OpenAI 1.x-Python-bibliotheek. Als u wilt profiteren van deze parameter, raden we u aan om een upgrade uit te voeren naar de nieuwste versie: pip install openai --upgrade.

De MTEB-benchmarktests van OpenAI hebben vastgesteld dat zelfs wanneer de afmetingen van het derde generatiemodel worden verlaagd tot minder dan de 1536 dimensies van text-embeddings-ada-002, de prestaties iets beter blijven.

Overzichtstabel van model en regionale beschikbaarheid

Modellen op implementatietype

Azure OpenAI biedt klanten keuzes in de hostingstructuur die past bij hun bedrijfs- en gebruikspatronen. De service biedt twee hoofdtypen van implementatie:

  • Standard: Heeft een USGov-gegevenszone-implementatieoptie, routering van verkeer binnen Azure Government om een hogere doorvoer te bieden.
  • Provisioned: Biedt ook een implementatieoptie voor datazone, zodat klanten geconfigureerde doorvoereenheden kunnen aanschaffen en implementeren in de infrastructuur van Azure Government.

Alle implementaties kunnen exact dezelfde deductiebewerkingen uitvoeren, maar de facturering, schaal en prestaties verschillen aanzienlijk. Zie de handleiding Deployment types voor meer informatie over Azure OpenAI-implementatietypen.

Beschikbaarheid van Data Zone Standard-modellen

Regio gpt-5.6-sol, 2026-07-09 gpt-5.6-terra, 2026-07-09 gpt-5.6-luna, 2026-07-09 gpt-5.1, 2025-11-13 gpt-4.1, 2025-04-14 gpt-4.1-mini, 2025-04-14 o3-mini, 2025-01-31 gpt-4o, 2024-11-20 text-embedding-ada-002, 2 tekst-insluiten-3-groot, 1 tekst insluiten-3-klein, 1
usgovarizona -
usgovvirginia -

Embedding-modellen

Deze modellen kunnen alleen worden gebruikt met API-aanvragen voor insluiten.

Opmerking

text-embedding-3-large is het meest recente en meest geschikte insluitmodel. U kunt geen upgrade uitvoeren tussen het insluiten van modellen. Als u wilt migreren van gebruik text-embedding-ada-002 naar text-embedding-3-large, moet u nieuwe insluitingen genereren.

Model-ID Maximum aantal aanvragen (tokens) Uitvoerdimensies Trainingsgegevens (tot en met)
text-embedding-ada-002 (versie 2) 8,192 1,536 Sep 2021
text-embedding-ada-002 (versie 1) 2,046 1,536 Sep 2021
text-embedding-3-large 8,192 3,072 Sep 2021
text-embedding-3-small 8,192 1,536 Sep 2021

Opmerking

Wanneer u een matrix met invoer verzendt voor insluiten, is het maximum aantal invoeritems in de matrix per aanroep naar het eindpunt voor insluiten 2048.

Buitengebruikstelling van model

In sommige gevallen worden modellen buiten gebruik gesteld in Azure Government eerder of later dan in de commerciële cloud. Raadpleeg de handleiding voor buitengebruikstelling van modellen voor de meest recente informatie over buitengebruikstelling van modellen.