Résumé

Effectué

Tip

Pour plus d’informations, consultez l’onglet Texte et images !

Dans ce module, nous avons exploré des modèles compatibles avec la vision dans Microsoft Foundry et comment les utiliser pour analyser des images et générer des images et des vidéos d’origine.

Le module a couvert les modèles modals, qui prennent en charge l’analyse des images. Nous avons également abordé les modèles de génération d’images, tels que ceux de la famille GPT-Image, pour la création et la modification d’images à partir de requêtes à l’aide d’outils et API Foundry. Enfin, nous avons introduit la génération de vidéos avec des modèles Sora, qui permettent la création de texte à vidéo et d’image à vidéo via des jeux interactifs et des flux de travail REST asynchrones par programmation.

Globalement, les modèles IA visuels dans Microsoft Foundry permettent de combler l’écart entre les données visuelles et l’IA basée sur le langage. Ils permettent des scénarios tels que l’analyse de documents et d’images, les assistants visuels, les outils d’accessibilité et les agents d’IA multimodaux, ce qui rend la compréhension des images une extension naturelle des applications d'IA modernes.

Pour en savoir plus, consultez les liens suivants :