Résumé du cours
Cette formation d’une journée est consacrée au développement d’applications intelligentes capables de voir, interpréter et raisonner à partir d’images et de documents à l’aide de différents modèles multimodaux et d’outils basés sur des agents. Les participants découvrent comment combiner des contenus visuels et documentaires avec des modèles de langage afin de mettre en œuvre des processus d’extraction structurée d’informations, d’analyse et de prise de décision. La formation met l’accent sur des approches pratiques pour extraire des informations, orchestrer des outils et contextualiser les réponses des modèles à partir de données visuelles.
A qui s'adresse cette formation
Cette formation est conçue pour les développeurs, ingénieurs IA et professionnels techniques souhaitant créer des applications capables de traiter des images et des documents à l’aide d’approches multimodales et pilotées par des agents. Elle s’adresse particulièrement aux apprenants disposant de bases en programmation et d’une compréhension générale des concepts liés au cloud ou à l’intelligence artificielle.
Pré-requis
Il est recommandé d'avoir :
- Une connaissance de base de la programmation (idéalement en Python ou dans un langage équivalent).
- Une compréhension générale des concepts du cloud computing et de l'intelligence artificielle.
- Une première expérience du développement d'applications ou de l'utilisation d'API.
- Une familiarité avec les données non structurées telles que les images et les documents constitue un atout.
- Un intérêt pour l'IA générative, les modèles multimodaux et les solutions basées sur des agents intelligents.
Objectifs
A l'issue de ce cours, vous serez capable de :
- Développer des applications intelligentes capables d’exploiter et d’analyser des images, des vidéos et des documents à l’aide de modèles multimodaux.
- Mettre en œuvre des solutions de vision par ordinateur et d’IA générative avec Microsoft Foundry et les services Azure AI.
- Extraire et structurer des informations à partir de contenus visuels et documentaires grâce à Azure Content Understanding et Azure Document Intelligence.
- Créer des workflows de recherche, d’analyse et de prise de décision en combinant modèles d’IA, agents et données multimodales.
- Concevoir des solutions de recherche et d’exploration des connaissances à l’aide d’Azure AI Search pour valoriser les informations extraites des documents et contenus visuels.
Contenu
Développer une application d’IA générative intégrant des capacités de vision
- Introduction
- Utiliser un modèle compatible avec la vision dans le portail Microsoft Foundry
- Développer une application conversationnelle basée sur la vision
- Exercice – Développer une application conversationnelle intégrant des capacités de vision
- Évaluation du module
- Synthèse
Générer des images avec l’IA
- Introduction
- Que sont les modèles de génération d’images ?
- Découvrir les modèles de génération d’images dans le portail Microsoft Foundry
- Créer une application cliente utilisant un modèle de génération d’images
- Exercice – Générer des images avec l’IA
- Évaluation du module
- Synthèse
Générer des vidéos avec Microsoft Foundry
- Introduction
- Déployer un modèle de génération vidéo
- Générer une vidéo à partir d’un prompt
- Générer une vidéo en Python
- Exercice – Générer une vidéo avec Sora 2 dans Microsoft Foundry
- Évaluation du module
- Synthèse
Analyser des images avec Content Understanding
- Introduction
- Qu’est-ce que Content Understanding ?
- Analyser des images avec Content Understanding
- Exercice – Analyser des images avec Content Understanding
- Évaluation du module
- Synthèse
Créer une solution d’analyse multimodale avec Azure Content Understanding
- Introduction
- Qu’est-ce qu’Azure Content Understanding ?
- Créer un analyseur Content Understanding
- Utiliser l’API Content Understanding
- Exercice – Extraire des informations à partir de contenus multimodaux
- Évaluation du module
- Synthèse
Créer une application cliente Azure Content Understanding
- Introduction
- Préparer l’utilisation de l’API AI Content Understanding
- Créer un analyseur Content Understanding
- Analyser du contenu
- Exercice – Développer une application cliente Content Understanding
- Évaluation du module
- Synthèse
Extraire des données avec Azure Document Intelligence
- Introduction
- Qu’est-ce qu’Azure Document Intelligence ?
- Utiliser Document Intelligence Studio
- Utiliser les modèles prédéfinis
- Entraîner et utiliser des modèles personnalisés
- Exercice – Analyser des documents avec Document Intelligence
- Évaluation du module
- Synthèse
Créer une solution d’exploration des connaissances avec Azure AI Search
- Introduction
- Qu’est-ce qu’Azure AI Search ?
- Extraire des données à l’aide d’un indexeur
- Enrichir les données extraites grâce aux compétences IA
- Rechercher dans un index
- Conserver les informations extraites dans un magasin de connaissances (Knowledge Store)
- Exercice – Créer une solution d’exploration des connaissances
- Évaluation du module
- Synthèse
