DP-3011 : Implémentation d'une solution d'analyse de données avec Azure Databricks

________________________________________________________________

Ce cours vous intéresse ? Demandez plus d’informations.

📧info@nanforiberica.com • 📞+34 91 031 66 78 • 📱 +34 685 60 05 91 (WhatsApp) • 🏢 Nos bureaux

________________________________________________________________

⚠️ Cours retiré : Microsoft a retiré le matériel DP-3011 le 30 septembre 2026. Le contenu reste disponible à titre de référence. Le cours de remplacement est le DP-750: Implement data engineering solutions using Azure Databricks →

Cours : DP-3011 : Mise en œuvre d'une solution d'analyse de données avec Azure Databricks

Apprenez à tirer parti de tous les avantages d'Apache Spark et des clusters performants exécutés sur la plateforme Azure Databricks pour exécuter de grandes charges de travail d'ingénierie de données dans le cloud.

Objectifs de la formation DP-3011

  • Configurer un environnement de développement dans Azure Machine Learning
  • Préparer les données pour l'entraînement de modèles
  • Créer et configurer un script d'entraînement de modèles en tant que travail de commande
  • Gérer les artefacts via MLflow
  • Déployer un modèle pour une consommation en temps réel

 

Contenu du cours DP-3011 Mise en œuvre d'une solution d'analyse de données avec Azure Databricks

Module 1 : Explorer Azure Databricks

  • Introduction à Azure Databricks
  • Identification des charges de travail Azure Databricks
  • Description des concepts clés
  • Gouvernance des données via Unity Catalog et Microsoft Purview
  • Exercice : Explorer Azure Databricks

Module 2 : Réaliser une analyse de données avec Azure Databricks

  • Introduction
  • Ingestion de données avec Azure Databricks
  • Outils d'exploration de données dans Azure Databricks
  • Analyse de données via les API DataFrame
  • Exercice : Exploration de données avec Azure Databricks

Module 3 : Utilisation d'Apache Spark dans Azure Databricks

  • Introduction
  • Découvrir Spark
  • Création d'un cluster Spark
  • Utilisation de Spark dans les notebooks
  • Utilisation de Spark pour travailler avec des fichiers de données
  • Visualisation de données
  • Exercice : Utilisation de Spark dans Azure Databricks

Module 4 : Gestion des données avec Delta Lake

  • Introduction
  • Premiers pas avec Delta Lake
  • Gestion des transactions ACID
  • Mise en œuvre de la conformité de schéma
  • Contrôle de version des données et voyage dans le temps (time travel) dans Delta Lake
  • Intégrité des données avec Delta Lake
  • Exercice : Utilisation de Delta Lake dans Azure Databricks

Module 5 : Construction de pipelines de données avec Delta Live Tables

  • Introduction
  • Exploration de Delta Live Tables
  • Ingestion et intégration de données
  • Traitement en temps réel
  • Exercice : Création d'un pipeline de données avec Delta Live Tables

Module 6 : Mise en œuvre de charges de travail avec les flux de travail Azure Databricks

  • Introduction
  • Qu'est-ce que les flux de travail Azure Databricks ?
  • Description des composants clés des flux de travail Azure Databricks
  • Exploration des avantages des flux de travail Azure Databricks
  • Mise en œuvre de charges de travail via les flux de travail Azure Databricks
  • Exercice : Création d'un flux de travail Azure Databricks

 

Prérequis

Aucun prérequis

 

Langue

  • Cours : Anglais / Espagnol
  • Labs : Anglais / Espagnol

________________________________________________________________

Ce cours vous intéresse ? Demandez plus d’informations.

📧info@nanforiberica.com • 📞+34 91 031 66 78 • 📱 +34 685 60 05 91 (WhatsApp) • 🏢 Nos bureaux

________________________________________________________________

Informations liées à la formation

Soporte siempre a tu lado

Accompagnement à la formation : Toujours à vos côtés

Modalidades Formativas

Avez-vous besoin d'une autre modalité de formation?

bonificaciones

Bonus pour les entreprises