Английский — B1

Data Engineer с опытом 3+ лет в разработке и оптимизации ETL/ELT-пайплайнов. Проектирую и сопровождаю хранилища данных, витрины для аналитики. Работал в ритейле, IT, госсекторе и с финансовыми данными. Владею Apache Spark (PySpark), Airflow, Kafka, Greenplum, Clickhouse. Постоянно улучшаю производительность БД и pipelines. Легко осваиваю новые технологии и эффективно работаю в команде.
Сертификаты:
Основы физического дизайна и оптимизация баз данных Greenplum
Программирование на языках pgSQL и PL/pgSQL
Расширенные возможности языка pgSQL

Проект по миграции крупных объёмов данных в озеро данных на базе Apache Iceberg и S3. Разработал высокопроизводительные ETL/ELT-пайплайны на PySpark с автоматическим обновлением витрин через DBT и SparkSQL. Настроил оркестрацию в Airflow (DAG-и для миграции и трансформации). Результат: снижение времени обработки на 30%, переход на актуальное хранилище.
Разработка пайплайнов для интеграции потоковых данных из Kafka в системы отчётности. Оптимизировал существующие Spark-приложения и SQL-запросы (PostgreSQL, Greenplum). Реализовал дашборды в Grafana для мониторинга производительности pipelines. Достигнуто ускорение обработки на 25%, снижена нагрузка на БД.
Cпроектировал и реализовал ETL-пайплайны на Apache Spark для обработки данных потребителей (Госэнергогазнадзор). Разработал витрины данных и дашборды в Clickhouse. Настроил оркестрацию в Airflow, автоматизировал тестирование PL/pgSQL-функций в Docker. Интегрировал данные в веб-сервисы. Обеспечена надёжная отчётность и снижение ручного труда.

Оставьте заявку и, наша команда в кратчайшие сроки подберёт необходимого специалиста за вас!
Помните, что заключение договора и оплата услуг происходит после того, как вы выбрали специалиста
