МегаТех14 дней назад
Data Engineer (Стажер)
Зарплата не указана
no_experienceМосква
Навыки
BigData
Обязанности
- 01Проектирование и разработка отказоустойчивых ETL/ELT процессов в экосистеме Hadoop и Oracle
- 02Оптимизация и сопровождение пайплайнов данных (Spark, PySpark, Airflow)
- 03Интеграция новых источников данных и построение витрин для бизнес-заказчиков
- 04Обеспечение качества и актуальности данных в продуктивных системах
- 05Участие в архитектурных решениях по хранению и обработке больших данных
- 06Ad-hoc аналитика и поддержка команд аналитиков и data scientist
Требования
- 01Высшее техническое образование (или завершающая стадия обучения)
- 02Опыт разработки на Python (написание скриптов, работа с библиотеками pandas, requests) от 6 месяцев (в т.ч. в рамках учебных проектов или стажировок)
- 03Уверенное знание SQL (написание сложных запросов, оконные функции, понимание планов выполнения, нормализация БД)
- 04Понимание основ архитектуры больших данных (понятия ETL/ELT, колоночные и реляционные хранилища, форматы хранения Parquet/ORC)
- 05Знакомство с концепциями оркестрации (Airflow) или опыт настройки простых пайплайнов в учебных целях
- 06Понимание принципов работы с системами контроля версий (Git) и умение работать в команде над кодом
- 07Базовые навыки работы в Linux (навигация по файловой системе, права доступа, простые bash-скрипты)
- 08Готовность к быстрому освоению технологий экосистемы Hadoop/Spark
- 09Навыки самостоятельного поиска информации и решения технических задач
- 10Опыт использования LLM-агентов и AI-ассистентов (например, Cursor, Claude Code) для генерации, рефакторинга и отладки инженерного кода