DP-900 · Concepts de données

Concepts de données : 12 questions DP-900 corrigées

« Concepts de données » est l'un des 4 domaines évalués à l'examen Microsoft DP-900. Voici 12 questions de ce domaine, chacune avec sa bonne réponse et son explication.

12 questions corrigées ici124 sur ce domaine dans la préparation481 pour toute la DP-900

Masque les réponses pour te tester avant de lire les corrigés.
  1. 1. Quel professionnel est le plus susceptible de créer des rapports et des tableaux de bord dans Power BI pour aider l'entreprise à comprendre ses données ?

    • Architecte réseau
    • Data analyst
    • Data engineer
    • Database administrator

    Réponse : Data analyst

    L'analyste de données transforme les chiffres en décisions : rapports, tableaux de bord, mesures. L'ingénieur de données lui fournit la matière, l'administrateur veille sur le moteur, et un architecte réseau n'intervient à aucun moment sur le contenu des données.

  2. 2. Quel rôle est principalement chargé de la disponibilité, de la sécurité, des sauvegardes et des performances d'une base de données ?

    • Chef de projet
    • Data engineer
    • Database administrator
    • Data analyst

    Réponse : Database administrator

    Disponibilité, sécurité, sauvegardes et performances définissent l'administrateur de base de données. L'ingénieur de données construit les pipelines en amont, l'analyste exploite le contenu, et un chef de projet coordonne sans intervenir sur le moteur.

  3. 3. Quel format de fichier est généralement considéré comme un exemple de données structurées ?

    • Une photographie enregistrée au format JPEG
    • Un enregistrement sonore au format MP3
    • Un fichier CSV avec des colonnes définies
    • Un document PDF issu d'une numérisation

    Réponse : Un fichier CSV avec des colonnes définies

    Structuré signifie qu'un schéma est fixé d'avance : chaque ligne porte les mêmes colonnes, avec le même type de données. Une image, un son ou un PDF numérisé contiennent de l'information, mais aucune organisation exploitable par une requête sans traitement préalable.

  4. 4. Quelle affirmation décrit le mieux les données semi-structurées ?

    • Elles suivent strictement un schéma relationnel
    • Elles ont une organisation via des balises ou clés mais pas de schéma tabulaire rigide
    • Elles ne peuvent être stockées que dans des fichiers binaires
    • Elles n'ont aucune organisation interne

    Réponse : Elles ont une organisation via des balises ou clés mais pas de schéma tabulaire rigide

    Balises ou clés organisent l'information sans imposer de colonnes identiques partout : c'est le semi-structuré. Suivre strictement un schéma relationnel en ferait du structuré, n'avoir aucune organisation interne du non structuré, et rien n'oblige à passer par des fichiers binaires.

  5. 5. Une application bancaire qui enregistre instantanément chaque retrait et dépôt utilise principalement quel type de traitement ?

    • OLAP
    • OLTP
    • Traitement par lots nocturne
    • Data mining

    Réponse : OLTP

    Chaque retrait est une transaction courte à valider immédiatement : c'est de l'OLTP. OLAP sert à analyser des mois d'historique, le traitement par lots nocturne diffère volontairement le travail, et le data mining cherche des motifs — trois usages qui supposent que les écritures ont déjà eu lieu.

  6. 6. Quelle caractéristique est typiquement associée à une charge de travail OLAP plutôt qu'OLTP ?

    • Requêtes de lecture complexes agrégeant de grandes quantités de données
    • Nombreuses écritures individuelles à faible latence
    • Verrouillage fréquent d'enregistrements individuels
    • Transactions courtes de type insertion unique

    Réponse : Requêtes de lecture complexes agrégeant de grandes quantités de données

    OLAP se reconnaît à ses lectures complexes et à ses agrégations sur de gros volumes. Les écritures individuelles à faible latence, le verrouillage fréquent d'enregistrements et les transactions courtes d'insertion décrivent au contraire une charge OLTP.

  7. 7. Quel rôle collabore souvent avec le data engineer pour nettoyer et modéliser les données avant de les présenter aux décideurs ?

    • Développeur front-end
    • Data analyst
    • Ingénieur réseau
    • Administrateur système

    Réponse : Data analyst

    L'analyste de données reprend ce que l'ingénieur a préparé, le modélise et le présente aux décideurs. Un développeur front-end construit des interfaces, un ingénieur réseau relie les machines, et un administrateur système veille sur les serveurs — aucun ne travaille le contenu.

  8. 8. Le contenu d'e-mails, de publications de réseaux sociaux et de documents texte libres relève généralement de quelle catégorie ?

    • Données relationnelles
    • Données non structurées
    • Données structurées
    • Données transactionnelles

    Réponse : Données non structurées

    Un courriel ou un billet de réseau social n'a pas de schéma : le texte libre et les médias forment des données non structurées. Les données structurées tiennent dans des lignes et des colonnes, les données relationnelles dans des tables liées, et les données transactionnelles décrivent un usage, pas un format.

  9. 9. Quel est l'objectif principal de la visualisation de données ?

    • Supprimer les données devenues obsolètes dans les jeux analysés
    • Compresser les données afin d'économiser de l'espace de stockage
    • Représenter les données graphiquement pour en faciliter la compréhension et l'analyse
    • Chiffrer les données sensibles avant leur diffusion aux équipes

    Réponse : Représenter les données graphiquement pour en faciliter la compréhension et l'analyse

    L'œil humain repère une tendance ou une rupture sur un graphique bien plus vite que dans un tableau de milliers de lignes. La visualisation ne modifie pas les données : elle en change la lisibilité. Suppression, compression et chiffrement agissent sur les données elles-mêmes.

  10. 10. Quel type de visualisation est le plus approprié pour comparer les ventes totales entre plusieurs catégories de produits ?

    • Un nuage de points
    • Un graphique linéaire de tendance
    • Un graphique à barres
    • Une carte de chaleur géographique

    Réponse : Un graphique à barres

    Le graphique à barres compare des grandeurs entre catégories distinctes, la longueur se lisant d'un coup d'œil. Le nuage de points sert à confronter deux variables numériques, le graphique linéaire suit une évolution dans le temps, et la carte de chaleur suppose une dimension géographique.

  11. 11. Quel type de graphique est le mieux adapté pour montrer l'évolution d'une valeur dans le temps ?

    • Un graphique linéaire
    • Un tableau de données brut
    • Un histogramme de fréquences
    • Un diagramme circulaire

    Réponse : Un graphique linéaire

    Le graphique linéaire relie les points dans l'ordre du temps : c'est ce tracé qui donne la tendance. Un tableau brut oblige à comparer les nombres mentalement, l'histogramme montre une distribution et non une chronologie, et le diagramme circulaire n'exprime que des parts d'un tout.

  12. 12. Dans le contexte des données, que signifie l'acronyme OLTP ?

    • Online Transfer Processing
    • Offline Transaction Protocol
    • Online Table Processing
    • Online Transaction Processing

    Réponse : Online Transaction Processing

    OLTP est l'abréviation d'Online Transaction Processing, le traitement transactionnel en ligne. Les autres formules mêlent des mots plausibles — transfer, offline, table — mais aucune ne désigne un concept réel : c'est bien la transaction, traitée en ligne, qui donne son nom à la catégorie.