Microsoft DP-3027: Впровадження рішення для інженерії даних за допомогою Azure Збір даних

Цей курс навчить вас, як використовувати можливості Apache Spark та високопродуктивних кластерів платформи. Azure Цеглини даних для виконання складних завдань інженерії даних у cloudВи дослідите архітектури потокової обробки, впровадите автоматизовані процеси та зрозумієте, як оптимізувати продуктивність за допомогою дельта-таблиць у реальному часі. Крім того, ви навчитеся оркеструвати та контролювати процеси обробки даних за допомогою... Azure Робота з Databricks, застосування заходів управління та безпеки до даних та інтеграція Databricks з іншими сервісами Azure.

Кому воно адресоване?

Курс рекомендований для:

  • Інженери даних, які розробляють масштабні рішення для обробки даних.
  • Аналітики даних, яким потрібно використовувати Azure Цеглини даних для підготовки та обробки великих наборів даних.
  • Розробники ELT, які впроваджують складні потоки даних у cloud.
  • Фахівці, які хочуть навчитися оркеструвати, захищати та оптимізувати процеси обробки даних у Azure Збірники даних.

Що ти навчишся?

Після завершення курсу ви знатимете, як:

  • Впроваджуйте інкрементальні процеси за допомогою структурованої потокової передачі Spark.
  • Розробляйте потокові архітектури за допомогою Delta Live Tables.
  • Оптимізуйте продуктивність робочих навантажень даних у Spark та Delta Live Tables.
  • Створення та керування робочими процесами CI/CD у Azure Збірники даних.
  • Автоматизуйте та оркеструйте потоки даних Azure Робота з Databricks та Azure Фабрика даних.
  • Керуйте безпекою даних, конфіденційністю та управлінням за допомогою каталогу Unity.
  • Ви використовуєте SQL Warehouses у Azure Цеглини даних для реляційних запитів.
  • бігти Azure Блокноти Databricks у Azure Фабрика даних для масштабування процесів інженерії даних.

Передумови:

Немає жодних передумов.

Розклад курсу:

Матеріали курсу англійською мовою. Викладання ведеться румунською мовою.

  1. Інкрементальна обробка за допомогою структурованого потокового передавання Spark
    • Вступ до структурованого потокового передавання Spark
    • Впровадження та моніторинг поступових процесів
  2. Архітектури потокової передачі з таблицями Delta Live
    • Архітектурні моделі для даних реального часу
    • Використання дельта-таблиць у реальному часі для потокових процесів
  3. Оптимізація продуктивності за допомогою Spark та Delta Live Tables
    • Стратегії оптимізації виконання в Spark
    • Підвищення продуктивності конвеєрів даних
  4. Впровадження робочих процесів CI/CD у Azure Збір даних
    • Безперервна інтеграція та доставка
    • Автоматизація розгортання коду та процесів
  5. Автоматизуйте завдання за допомогою Azure Робота з Databricks
    • Створення та планування завдань у Azure Збір даних
    • Інтеграція з Azure Фабрика даних та Azure DevOps
    • Процеси моніторингу та масштабування
  6. Управління даними та їхня безпека в Azure Збір даних
    • Каталог Unity та контроль доступу до даних
    • Управління конфіденційністю та дотриманням вимог
  7. Використання SQL Warehouses у Azure Збір даних
    • Реляційні SQL-запити до великих наборів даних
    • Оптимізація аналізу за допомогою SQL Warehouses
  8. Запуск блокнотів Databricks з Azure Фабрика даних
    • Інтеграція блокнотів у конвеєри даних
    • Автоматизація процесів обробки даних у великих масштабах cloud

Рекомендуємо продовжити:

Програми сертифікації

Наразі програм сертифікації немає.

Microsoft DP-3027: Впровадження рішення для інженерії даних за допомогою Azure Збір даних

Індивідуальні пропозиції для груп від 2 осіб

Деталі курсу

Тривалість:

1
днів

Ціна:

На вимогу

Доставка:

Викладання в класі, гібридний клас, віртуальний клас

Рівень:

3. Середній

Ролі:

Аналітик даних, інженер даних, спеціаліст з обробки даних