Microsoft DP-3027: Implementar una solución de ingeniería de datos con Azure Databricks

Este curso le enseña cómo aprovechar el poder de Apache Spark y los clústeres de alta capacidad en la plataforma. Azure Databricks para ejecutar tareas complejas de ingeniería de datos en cloudExplorarás arquitecturas de procesamiento de streaming, implementarás procesos automatizados y comprenderás cómo optimizar el rendimiento con Delta Live Tables. Además, aprenderás a orquestar y supervisar procesos de datos mediante Azure Empleos en Databricks: aplicar medidas de gobernanza y seguridad a los datos e integrar Databricks con otros servicios Azure.

¿A quién está dirigido?

El curso está recomendado para:

  • Ingenieros de datos que desarrollan soluciones de procesamiento de datos a gran escala.
  • Científicos de datos que necesitan utilizar Azure Databricks para preparar y procesar grandes conjuntos de datos.
  • Desarrolladores ELT que implementan flujos de datos complejos en cloud.
  • Profesionales que quieran aprender a orquestar, proteger y optimizar los procesos de datos en Azure Ladrillos de datos.

¿Que aprenderás?

Al finalizar el curso sabrás cómo:

  • Implemente procesos incrementales utilizando Spark Structured Streaming.
  • Desarrolle arquitecturas de streaming con Delta Live Tables.
  • Optimice el rendimiento de las cargas de trabajo de datos en Spark y Delta Live Tables.
  • Cree y administre flujos de trabajo de CI/CD en Azure Ladrillos de datos.
  • Automatizar y orquestar los flujos de datos a través de Azure Empleos en Databricks y Azure Fábrica de datos.
  • Administre la seguridad, la privacidad y la gobernanza de los datos con Unity Catalog.
  • Utiliza almacenes SQL en Azure Databricks para consultas relacionales.
  • correr Azure Cuadernos de Databricks en Azure Data Factory para escalar procesos de ingeniería de datos.

requisitos previos:

No hay requisitos previos.

Calendario de cursos:

Los materiales del curso están en inglés. La enseñanza se realiza en rumano.

  1. Procesamiento incremental con Spark Structured Streaming
    • Introducción a la transmisión estructurada Spark
    • Implementación y seguimiento de procesos incrementales
  2. Arquitecturas de transmisión con tablas Delta Live
    • Modelos arquitectónicos para datos en tiempo real
    • Uso de tablas Delta Live para procesos de streaming
  3. Optimización del rendimiento con Spark y Delta Live Tables
    • Estrategias de optimización de la ejecución en Spark
    • Aumentar el rendimiento de las canalizaciones de datos
  4. Implementación de flujos de trabajo de CI/CD en Azure Databricks
    • Integración y entrega continuas
    • Automatizar la implementación de código y procesos
  5. Automatizar tareas con Azure Empleos en Databricks
    • Creación y programación de trabajos en Azure Databricks
    • Integración con Azure Fábrica de datos y Azure DevOps
    • Procesos de seguimiento y escalamiento
  6. Gobernanza y seguridad de datos en Azure Databricks
    • Catálogo de Unity y control de acceso a datos
    • Gestión de la privacidad y el cumplimiento
  7. Uso de almacenes SQL en Azure Databricks
    • Consultas SQL relacionales en grandes conjuntos de datos
    • Optimización del análisis mediante almacenes SQL
  8. Ejecución de cuadernos de Databricks con Azure Fábrica de datos
    • Integración de cuadernos en canalizaciones de datos
    • Automatización de procesos de ingeniería de datos a escala cloud

Recomendamos continuar con:

Programas de certificación

No hay programas de certificación en este momento.

Microsoft DP-3027: Implementar una solución de ingeniería de datos con Azure Databricks

Ofertas personalizadas para grupos de al menos 2 personas.

Detalles del curso

Duración:

1
días

Precio:

Bajo demanda

Entrega:

Docencia Presencial, Aula Híbrida, Aula Virtual

Nivel:

3. intermedio

Funciones:

Analista de datos, Ingeniero de datos, Científico de datos