Този курс ви учи как да използвате мощта на Apache Spark и клъстерите с висок капацитет в платформата. Azure Databricks за изпълнение на сложни задачи по инженерство на данни в cloudЩе разгледате архитектурите за стрийминг обработка, ще внедрите автоматизирани процеси и ще разберете как да оптимизирате производителността, използвайки Delta Live Tables. Освен това ще се научите да организирате и наблюдавате процесите на данни чрез... Azure Работа в Databricks, прилагане на мерки за управление и сигурност към данните и интегриране на Databricks с други услуги Azure.
Курсът се препоръчва за:
- Инженери по данни, които разработват решения за обработка на данни в голям мащаб.
- Специалисти по данни, които трябва да използват Azure Databricks за подготовка и обработка на големи масиви от данни.
- Разработчици на английски език, които внедряват сложни потоци от данни в cloud.
- Професионалисти, които искат да се научат как да организират, защитят и оптимизират процесите на обработка на данни в Azure Датчици за данни.
След завършване на курса ще знаете как да:
- Внедрете инкрементални процеси, използвайки Spark Structured Streaming.
- Разработвайте стрийминг архитектури с Delta Live Tables.
- Оптимизирайте производителността на работните натоварвания с данни в Spark и Delta Live Tables.
- Създавайте и управлявайте CI/CD работни процеси в Azure Датчици за данни.
- Автоматизирайте и организирайте потоците от данни Azure Работа с Databricks и Azure Фабрика за данни.
- Управлявайте сигурността, поверителността и управлението на данните с Unity Catalog.
- Използвате SQL Warehouses в Azure Databricks за релационни заявки.
- бягам Azure Бележници с Databricks в Azure Фабрика за данни за мащабиране на процесите на инженерство на данни.
Няма предпоставки.
- Инкрементална обработка със Spark Structured Streaming
- Въведение в структурираното стрийминг на Spark
- Внедряване и наблюдение на постепенни процеси
- Стрийминг архитектури с Delta Live таблици
- Архитектурни модели за данни в реално време
- Използване на Delta Live Tables за стрийминг процеси
- Оптимизиране на производителността с таблици Spark и Delta Live
- Стратегии за оптимизация на изпълнението в Spark
- Повишаване на производителността на каналите за данни
- Внедряване на CI/CD работни процеси в Azure Датчици за данни
- Непрекъсната интеграция и доставка
- Автоматизирайте внедряването на код и процеси
- Автоматизирайте задачи с Azure Работа в Databricks
- Създаване и планиране на задачи в Azure Датчици за данни
- Интеграция с Azure Фабрика за данни и Azure DevOps
- Процеси на мониторинг и мащабиране
- Управление на данните и сигурност в Azure Датчици за данни
- Каталог на Unity и контрол на достъпа до данни
- Управление на поверителността и съответствието
- Използване на SQL хранилища в Azure Датчици за данни
- Релационни SQL заявки към големи масиви от данни
- Оптимизация на анализа чрез SQL Warehouses
- Изпълнение на Databricks Notebooks с Azure Фабрика за данни
- Интегриране на преносими компютри в канали за данни
- Автоматизиране на процесите на инженерство на данни в голям мащаб cloud
- Microsoft DP-3011: Внедряване на решение за анализ на данни с Azure Датчици за данни
- Microsoft DP-3012: Внедряване на решение за анализ на данни с Azure Synapse Analytics
- Microsoft DP-500: Проектиране и внедряване на решения за анализ в корпоративен мащаб с помощта на Microsoft Azure намлява Microsoft Power BI
В момента няма програми за сертифициране.

