Цей курс навчить вас, як використовувати можливості Apache Spark та високопродуктивних кластерів платформи. Azure Цеглини даних для виконання складних завдань інженерії даних у cloudВи дослідите архітектури потокової обробки, впровадите автоматизовані процеси та зрозумієте, як оптимізувати продуктивність за допомогою дельта-таблиць у реальному часі. Крім того, ви навчитеся оркеструвати та контролювати процеси обробки даних за допомогою... Azure Робота з Databricks, застосування заходів управління та безпеки до даних та інтеграція Databricks з іншими сервісами Azure.
Курс рекомендований для:
- Інженери даних, які розробляють масштабні рішення для обробки даних.
- Аналітики даних, яким потрібно використовувати Azure Цеглини даних для підготовки та обробки великих наборів даних.
- Розробники ELT, які впроваджують складні потоки даних у cloud.
- Фахівці, які хочуть навчитися оркеструвати, захищати та оптимізувати процеси обробки даних у Azure Збірники даних.
Після завершення курсу ви знатимете, як:
- Впроваджуйте інкрементальні процеси за допомогою структурованої потокової передачі Spark.
- Розробляйте потокові архітектури за допомогою Delta Live Tables.
- Оптимізуйте продуктивність робочих навантажень даних у Spark та Delta Live Tables.
- Створення та керування робочими процесами CI/CD у Azure Збірники даних.
- Автоматизуйте та оркеструйте потоки даних Azure Робота з Databricks та Azure Фабрика даних.
- Керуйте безпекою даних, конфіденційністю та управлінням за допомогою каталогу Unity.
- Ви використовуєте SQL Warehouses у Azure Цеглини даних для реляційних запитів.
- бігти Azure Блокноти Databricks у Azure Фабрика даних для масштабування процесів інженерії даних.
Немає жодних передумов.
- Інкрементальна обробка за допомогою структурованого потокового передавання Spark
- Вступ до структурованого потокового передавання Spark
- Впровадження та моніторинг поступових процесів
- Архітектури потокової передачі з таблицями Delta Live
- Архітектурні моделі для даних реального часу
- Використання дельта-таблиць у реальному часі для потокових процесів
- Оптимізація продуктивності за допомогою Spark та Delta Live Tables
- Стратегії оптимізації виконання в Spark
- Підвищення продуктивності конвеєрів даних
- Впровадження робочих процесів CI/CD у Azure Збір даних
- Безперервна інтеграція та доставка
- Автоматизація розгортання коду та процесів
- Автоматизуйте завдання за допомогою Azure Робота з Databricks
- Створення та планування завдань у Azure Збір даних
- Інтеграція з Azure Фабрика даних та Azure DevOps
- Процеси моніторингу та масштабування
- Управління даними та їхня безпека в Azure Збір даних
- Каталог Unity та контроль доступу до даних
- Управління конфіденційністю та дотриманням вимог
- Використання SQL Warehouses у Azure Збір даних
- Реляційні SQL-запити до великих наборів даних
- Оптимізація аналізу за допомогою SQL Warehouses
- Запуск блокнотів Databricks з Azure Фабрика даних
- Інтеграція блокнотів у конвеєри даних
- Автоматизація процесів обробки даних у великих масштабах cloud
- Microsoft DP-3011: Впровадження рішення для аналізу даних за допомогою Azure Збір даних
- Microsoft DP-3012: Впровадження рішення для аналізу даних за допомогою Azure Synapse Analytics
- Microsoft DP-500: Проектування та впровадження аналітичних рішень корпоративного масштабу з використанням Microsoft Azure та Microsoft Потужність БІ
Наразі програм сертифікації немає.

