Databricks Certified Data Engineer Professional – Examen Blanc

Partager

À propos du cours

Certification Databricks🌐 Anglais & Français

Databricks Certified Data Engineer Professional

Code officiel : Data Engineer Professional

Disponible en anglais et en français — examens blancs complets dans les deux langues.

59questions à l’examen réel
120 mindurée officielle
200 $prix de l’examen
2 ansvalidité

Choisissez un abonnement (à partir de 9,90 €/mois, 47 certifications) et accédez immédiatement à l'examen blanc complet, ainsi qu'à ces 4 outils d'entraînement supplémentaires :

Glossaire — 25 termes clés

APPLY CHANGESSyntaxe propre aux pipelines Lakeflow Declarative Pipelines permettant de propager des changements CDC (SCD Type 1 ou Type 2) dans une table Delta cible, en gérant automatiquement les insertions, mises à jour et suppressions.
AQE (Adaptive Query Execution)Fonctionnalité de Spark qui optimise dynamiquement les plans d'exécution à l'exécution, notamment via la coalescence de partitions, le broadcast dynamique et la détection du data skew.
Auto LoaderFonctionnalité Databricks permettant l'ingestion incrémentielle et scalable de fichiers depuis un stockage cloud vers Delta Lake, avec détection automatique des nouveaux fichiers et évolution du schéma.
availableNowOption de trigger pour le Structured Streaming Spark qui traite toutes les données disponibles au moment du déclenchement puis s'arrête, combinant les avantages du traitement batch et streaming.
Voir les 21 autres termes →

Étude de cas — 5 scénarios inclus

Migration Lakehouse d'un opérateur télécom vers Unity Catalog

4,2 milliards d'événements/jourVolume quotidien d'événements réseau1 200 tables réparties sur 3 environnementsNombre de tables à migrer6 moisDélai de conformité RGPD18 ingénieurs répartis en 4 squadsÉquipe data engineering

TelecomPlus est un opérateur télécom européen qui traite quotidiennement des milliards d'événements réseau (appels, SMS, données mobiles). Leur infrastructure actuelle repose sur un data lake S3 non gouverné, avec des points de montage DBFS hérités et aucune traçabilité des accès. Face aux exigences du RGPD et à une audit de conformité planifiée dans 6 mois, la DSI a mandaté une migration complète vers Unity Catalog sur Databricks.

Voir les questions d'analyse et réponses modèles →

Texte à trous — 25 phrases incluses

Pour propager les suppressions et mises à jour d'une table source vers une table Delta cible en conservant l'historique des versions, le pipeline Lakeflow Declarative utilise la syntaxe _____ INTO avec le paramètre SEQUENCE BY pour garantir l'ordre des opérations CDC.

Grâce à _____, Spark ajuste dynamiquement le nombre de partitions de sortie après un shuffle coûteux, évitant ainsi de créer des milliers de petites partitions inutiles lors d'une agrégation sur une table de plusieurs téraoctets.

Plutôt que de scanner manuellement un bucket S3 pour détecter les nouveaux fichiers JSON déposés chaque heure, l'équipe data a mis en place _____ qui s'appuie sur les notifications d'événements cloud pour ne traiter que les fichiers réellement ajoutés depuis la dernière exécution.

Voir les réponses et le reste des phrases →

Flashcards — 192 cartes incluses

Question

Quelle approche permet d'identifier le plus efficacement la source de l'anomalie de coût ?

Appuyer pour voir la réponse ›
Réponse

Interroger `system.billing.usage` pour agréger la consommation de DBU par `sku_name`, `workspace_id` et `usage_date`, puis comparer mois après mois

Question

Quelle approche permet d'implémenter la sécurité au niveau des lignes dans Unity Catalog ?

Appuyer pour voir la réponse ›
Réponse

Utiliser des vues dynamiques avec la fonction `current_user()`

Voir les 190 autres cartes →
Commencer maintenant

Texte à trous — 25 phrases incluses

Pour propager les suppressions et mises à jour d'une table source vers une table Delta cible en conservant l'historique des versions, le pipeline Lakeflow Declarative utilise la syntaxe _____ INTO avec le paramètre SEQUENCE BY pour garantir l'ordre des opérations CDC.

Grâce à _____, Spark ajuste dynamiquement le nombre de partitions de sortie après un shuffle coûteux, évitant ainsi de créer des milliers de petites partitions inutiles lors d'une agrégation sur une table de plusieurs téraoctets.

Plutôt que de scanner manuellement un bucket S3 pour détecter les nouveaux fichiers JSON déposés chaque heure, l'équipe data a mis en place _____ qui s'appuie sur les notifications d'événements cloud pour ne traiter que les fichiers réellement ajoutés depuis la dernière exécution.

Voir les réponses et le reste des phrases →

Contenu du cours

Databricks Certified Data Engineer Professional – Examen Blanc (Français)

  • Databricks Data Engineer Professional — Examen 1 (Français) (66 questions)
  • Présentation
  • Databricks Data Engineer Professional — Examen 2 (Français) (63 questions)
  • Fiche mémo
  • Databricks Data Engineer Professional — Examen 3 (Français) (63 questions)
  • Modalités
  • Documents
  • Glossaire — Termes clés
  • Études de cas — Mise en situation
  • Texte à trous — Exercice de complétion
  • Flashcards — Révision express

Databricks Certified Data Engineer Professional – Mock Exam (English)

Retour en haut