Microsoft DP-3027: Внедряване на решение за инженерство на данни с Azure Датчици за данни

Този курс ви учи как да използвате мощта на Apache Spark и клъстерите с висок капацитет в платформата. Azure Databricks за изпълнение на сложни задачи по инженерство на данни в cloudЩе разгледате архитектурите за стрийминг обработка, ще внедрите автоматизирани процеси и ще разберете как да оптимизирате производителността, използвайки Delta Live Tables. Освен това ще се научите да организирате и наблюдавате процесите на данни чрез... Azure Работа в Databricks, прилагане на мерки за управление и сигурност към данните и интегриране на Databricks с други услуги Azure.

Към кого е адресирано?

Курсът се препоръчва за:

  • Инженери по данни, които разработват решения за обработка на данни в голям мащаб.
  • Специалисти по данни, които трябва да използват Azure Databricks за подготовка и обработка на големи масиви от данни.
  • Разработчици на английски език, които внедряват сложни потоци от данни в cloud.
  • Професионалисти, които искат да се научат как да организират, защитят и оптимизират процесите на обработка на данни в Azure Датчици за данни.

Какво ще научите?

След завършване на курса ще знаете как да:

  • Внедрете инкрементални процеси, използвайки Spark Structured Streaming.
  • Разработвайте стрийминг архитектури с Delta Live Tables.
  • Оптимизирайте производителността на работните натоварвания с данни в Spark и Delta Live Tables.
  • Създавайте и управлявайте CI/CD работни процеси в Azure Датчици за данни.
  • Автоматизирайте и организирайте потоците от данни Azure Работа с Databricks и Azure Фабрика за данни.
  • Управлявайте сигурността, поверителността и управлението на данните с Unity Catalog.
  • Използвате SQL Warehouses в Azure Databricks за релационни заявки.
  • бягам Azure Бележници с Databricks в Azure Фабрика за данни за мащабиране на процесите на инженерство на данни.

Предпоставки:

Няма предпоставки.

График на курса:

Материалите на курса са на английски език. Обучението се води на румънски език.

  1. Инкрементална обработка със Spark Structured Streaming
    • Въведение в структурираното стрийминг на Spark
    • Внедряване и наблюдение на постепенни процеси
  2. Стрийминг архитектури с Delta Live таблици
    • Архитектурни модели за данни в реално време
    • Използване на Delta Live Tables за стрийминг процеси
  3. Оптимизиране на производителността с таблици Spark и Delta Live
    • Стратегии за оптимизация на изпълнението в Spark
    • Повишаване на производителността на каналите за данни
  4. Внедряване на CI/CD работни процеси в Azure Датчици за данни
    • Непрекъсната интеграция и доставка
    • Автоматизирайте внедряването на код и процеси
  5. Автоматизирайте задачи с Azure Работа в Databricks
    • Създаване и планиране на задачи в Azure Датчици за данни
    • Интеграция с Azure Фабрика за данни и Azure DevOps
    • Процеси на мониторинг и мащабиране
  6. Управление на данните и сигурност в Azure Датчици за данни
    • Каталог на Unity и контрол на достъпа до данни
    • Управление на поверителността и съответствието
  7. Използване на SQL хранилища в Azure Датчици за данни
    • Релационни SQL заявки към големи масиви от данни
    • Оптимизация на анализа чрез SQL Warehouses
  8. Изпълнение на Databricks Notebooks с Azure Фабрика за данни
    • Интегриране на преносими компютри в канали за данни
    • Автоматизиране на процесите на инженерство на данни в голям мащаб cloud

Препоръчваме да продължите с:

Сертификационни програми

В момента няма програми за сертифициране.

Microsoft DP-3027: Внедряване на решение за инженерство на данни с Azure Датчици за данни

Персонализирани оферти за групи от минимум 2 човека

Подробности за курса

Продължителност:

1
дни

Цена:

При поискване

Доставка:

Преподаване в класна стая, хибридна класна стая, виртуална класна стая

Ниво:

3. Средно

Роли:

Анализатор на данни, Инженер на данни, Специалист по данни