Implémenter des solutions d'extraction d'informations1 / 5
Tu dois ingérer des PDF mixtes, contenant à la fois du texte rédigé et des graphiques/schémas intégrés, dans un index Azure AI Search pour du RAG multimodal. Tu veux un seul skill qui analyse la mise en page, produit du Markdown préservant la structure des sections et extrait les images avec des métadonnées de localisation, pour que les chunks restent près des figures associées. Quel skill intégré dois-tu utiliser ?
Bonne réponseRéponse incorrecte
Alex
Le skill Document Layout d'Azure AI Search appelle le modèle de layout d'Azure Document Intelligence pour détecter la structure du document et produire une représentation syntaxique en Markdown ou en texte. Son paramètre markdownHeaderDepth contrôle l'imbrication des sections et, lorsqu'il est configuré pour une sortie texte avec extraction d'images, il renvoie normalized_images ainsi que locationMetadata, qui conserve la position de chaque image dans le document. Garder les images près du contenu associé est précieux pour le RAG et la recherche multimodale. Le skill OCR, lui, se contente d'extraire le texte des images et ne produit pas de sections Markdown structurées ; le skill Image Analysis décrit le contenu d'une image mais ne découpe pas un document en chunks selon sa mise en page. Astuce d'examen : « du Markdown conscient de la structure plus des métadonnées de localisation des images pour du RAG multimodal » désigne le skill Document Layout, pas le simple OCR.
Sourcelearn.microsoft.com
Les réponses aux questions complémentaires sont disponibles dans l’app. Crée un compte gratuit, sans carte bancaire.
Question 1 sur 5
Créer un compte gratuit