Denne browser understøttes ikke længere.
Opgrader til Microsoft Edge for at drage fordel af de nyeste funktioner, sikkerhedsopdateringer og teknisk support.
Hvad er en multimodal model?
En model, der kun kan behandle billeder, men ikke tekst.
En model, der kan forstå og arbejde med mere end én type data, såsom tekst og billeder.
En model, der kun genererer videoindhold.
Hvordan kan udviklere programmatisk generere billeder ved hjælp af Foundry-billedgenereringsmodeller?
Ved at sende tekstprompts gennem OpenAI Responses API ved hjælp af en deployeret billedmodel
Ved at uploade billeder via Foundry Playground UI.
Ved at kalde GPT-4.1-modellens endpoint.
Når du genererer billeder programmatisk ved hjælp af OpenAI Python SDK med Microsoft Foundry, hvilken værdi skal du så sende som modelparameter i anmodningen?
Det oprindelige basismodelnavn (for eksempel gpt-image-1.5).
Det udrulningsnavn, du har givet billedgenereringsmodellen i din Foundry-ressource.
Navnet, du gav din Foundry-ressource.
Hvorfor håndteres videogenerering med Sora-modeller i Microsoft Foundry som et asynkront job?
Fordi videogenerering kræver brugerinteraktion under rendering.
Fordi REST API'en ikke understøtter synkrone forespørgsler.
Fordi videoproduktion er ressourcekrævende og tager tid at gennemføre.
Du skal svare på alle spørgsmål, før du kontrollerer dit arbejde.
Var denne side nyttig?
Har du brug for hjælp til dette emne?
Vil du prøve at bruge Ask Learn til at tydeliggøre eller guide dig gennem dette emne?