Este curso le enseña cómo aprovechar el poder de Apache Spark y los clústeres de alta capacidad en la plataforma. Azure Databricks para ejecutar tareas complejas de ingeniería de datos en cloudExplorarás arquitecturas de procesamiento de streaming, implementarás procesos automatizados y comprenderás cómo optimizar el rendimiento con Delta Live Tables. Además, aprenderás a orquestar y supervisar procesos de datos mediante Azure Empleos en Databricks: aplicar medidas de gobernanza y seguridad a los datos e integrar Databricks con otros servicios Azure.
El curso está recomendado para:
- Ingenieros de datos que desarrollan soluciones de procesamiento de datos a gran escala.
- Científicos de datos que necesitan utilizar Azure Databricks para preparar y procesar grandes conjuntos de datos.
- Desarrolladores ELT que implementan flujos de datos complejos en cloud.
- Profesionales que quieran aprender a orquestar, proteger y optimizar los procesos de datos en Azure Ladrillos de datos.
Al finalizar el curso sabrás cómo:
- Implemente procesos incrementales utilizando Spark Structured Streaming.
- Desarrolle arquitecturas de streaming con Delta Live Tables.
- Optimice el rendimiento de las cargas de trabajo de datos en Spark y Delta Live Tables.
- Cree y administre flujos de trabajo de CI/CD en Azure Ladrillos de datos.
- Automatizar y orquestar los flujos de datos a través de Azure Empleos en Databricks y Azure Fábrica de datos.
- Administre la seguridad, la privacidad y la gobernanza de los datos con Unity Catalog.
- Utiliza almacenes SQL en Azure Databricks para consultas relacionales.
- correr Azure Cuadernos de Databricks en Azure Data Factory para escalar procesos de ingeniería de datos.
No hay requisitos previos.
- Procesamiento incremental con Spark Structured Streaming
- Introducción a la transmisión estructurada Spark
- Implementación y seguimiento de procesos incrementales
- Arquitecturas de transmisión con tablas Delta Live
- Modelos arquitectónicos para datos en tiempo real
- Uso de tablas Delta Live para procesos de streaming
- Optimización del rendimiento con Spark y Delta Live Tables
- Estrategias de optimización de la ejecución en Spark
- Aumentar el rendimiento de las canalizaciones de datos
- Implementación de flujos de trabajo de CI/CD en Azure Databricks
- Integración y entrega continuas
- Automatizar la implementación de código y procesos
- Automatizar tareas con Azure Empleos en Databricks
- Creación y programación de trabajos en Azure Databricks
- Integración con Azure Fábrica de datos y Azure DevOps
- Procesos de seguimiento y escalamiento
- Gobernanza y seguridad de datos en Azure Databricks
- Catálogo de Unity y control de acceso a datos
- Gestión de la privacidad y el cumplimiento
- Uso de almacenes SQL en Azure Databricks
- Consultas SQL relacionales en grandes conjuntos de datos
- Optimización del análisis mediante almacenes SQL
- Ejecución de cuadernos de Databricks con Azure Fábrica de datos
- Integración de cuadernos en canalizaciones de datos
- Automatización de procesos de ingeniería de datos a escala cloud
- Microsoft DP-3011: Implementación de una solución de análisis de datos con Azure Databricks
- Microsoft DP-3012: Implementación de una solución de análisis de datos con Azure Análisis de sinapsis
- Microsoft DP-500: Diseño e implementación de soluciones de análisis a escala empresarial utilizando Microsoft Azure y Microsoft Power BI
No hay programas de certificación en este momento.

