Капоне
Администратор
- Регистрация
- 1 Апр 2015
- Сообщения
- 153.585
- Реакции
- 465.805
Курс по Data Engineering [SkillFactory] [М. Королев] Часть 1 из 2
Научитесь строить пайплайны данных в реальном времени
В современных компаниях накапливается большой объем данных, из которых можно извлекать важную аналитику, строить гипотезы или прогнозные модели.
Data Engineer — это специалист, который собирает данные из разных источников, очищает их и передает в удобном виде аналитикам для принятия бизнес-решений.
Аналитикам данных нужно знать, как работает хранилище данных, в каком виде там хранятся данные, как они обрабатываются и как их можно получить для анализа.
Курс ориентирован на практику и основные инструменты, подходит для тех, кто имеет базовые знания языка Python.
За два месяца вы освоите все важные этапы Data Engineering.
Программа курса
МОДУЛИ
1 Введение, практический linux
Кто такой Data Engineer и зачем ему Linux?
2 Современные хранилища данных
Разнообразие баз данных и их особенности
3 Экосистема Hadoop
Что такое Hadoop, что он умеет и как им пользоваться
4 Источники данных и работа с ними
Файлы как источники данных, JDBC — структурированные данные, SQL для выгрузки данных
5 Apache Spark и обработка данных
Зачем нужен Apache Spark и как с ним работать
6 Hadoop как хранилище данных
Особенности и нюансы hdfs
7 Apache Airflow для оркестрации конвейеров
Настройка data pipelines
8 Обзор облачных хранилищ
Особенности и нюансы работы с облачными хранилищами: Google, Amazon, Azure
Этот курс входит в программу Профессия «Data Scientist»
Научитесь строить пайплайны данных в реальном времени
В современных компаниях накапливается большой объем данных, из которых можно извлекать важную аналитику, строить гипотезы или прогнозные модели.
Data Engineer — это специалист, который собирает данные из разных источников, очищает их и передает в удобном виде аналитикам для принятия бизнес-решений.
Аналитикам данных нужно знать, как работает хранилище данных, в каком виде там хранятся данные, как они обрабатываются и как их можно получить для анализа.
Курс ориентирован на практику и основные инструменты, подходит для тех, кто имеет базовые знания языка Python.
За два месяца вы освоите все важные этапы Data Engineering.
Программа курса
МОДУЛИ
1 Введение, практический linux
Кто такой Data Engineer и зачем ему Linux?
2 Современные хранилища данных
Разнообразие баз данных и их особенности
3 Экосистема Hadoop
Что такое Hadoop, что он умеет и как им пользоваться
4 Источники данных и работа с ними
Файлы как источники данных, JDBC — структурированные данные, SQL для выгрузки данных
5 Apache Spark и обработка данных
Зачем нужен Apache Spark и как с ним работать
6 Hadoop как хранилище данных
Особенности и нюансы hdfs
7 Apache Airflow для оркестрации конвейеров
Настройка data pipelines
8 Обзор облачных хранилищ
Особенности и нюансы работы с облачными хранилищами: Google, Amazon, Azure
Этот курс входит в программу Профессия «Data Scientist»
Для просмотра скрытого содержимого вы должны зарегистрироваться
Возможно, Вас ещё заинтересует:
- [Шитье] Закрытый клуб (ноябрь 2026) [Альбина Скрипка]
- Подписка IF+, обучение, аналитика, портфели (1 месяц с 14.10.2026) [IF+] [Кира Юхтенко, Татьяна Юзвак, Александр Остриков]
- [Вязание] Вязаный спицами сверху без швов укороченный пуловер Oat плетённым узором [Вяжи.ру] [Amy Baldwin]
- [Вязание] Пуловер лицевой гладью Fromage [Вяжи.ру] [Лоне Кельдсен]
- [PSD] Коллаж Снежные барсы [nezabudka]
- [Выкройки] Ветровка Лисбет. Размер 42-50. Рост 160-166 [Whitewaterdress]