МегаТех14 дней назад

Data Engineer (Стажер)

Зарплата не указана
no_experienceМосква

Навыки

BigData

Обязанности

  • 01Проектирование и разработка отказоустойчивых ETL/ELT процессов в экосистеме Hadoop и Oracle
  • 02Оптимизация и сопровождение пайплайнов данных (Spark, PySpark, Airflow)
  • 03Интеграция новых источников данных и построение витрин для бизнес-заказчиков
  • 04Обеспечение качества и актуальности данных в продуктивных системах
  • 05Участие в архитектурных решениях по хранению и обработке больших данных
  • 06Ad-hoc аналитика и поддержка команд аналитиков и data scientist

Требования

  • 01Высшее техническое образование (или завершающая стадия обучения)
  • 02Опыт разработки на Python (написание скриптов, работа с библиотеками pandas, requests) от 6 месяцев (в т.ч. в рамках учебных проектов или стажировок)
  • 03Уверенное знание SQL (написание сложных запросов, оконные функции, понимание планов выполнения, нормализация БД)
  • 04Понимание основ архитектуры больших данных (понятия ETL/ELT, колоночные и реляционные хранилища, форматы хранения Parquet/ORC)
  • 05Знакомство с концепциями оркестрации (Airflow) или опыт настройки простых пайплайнов в учебных целях
  • 06Понимание принципов работы с системами контроля версий (Git) и умение работать в команде над кодом
  • 07Базовые навыки работы в Linux (навигация по файловой системе, права доступа, простые bash-скрипты)
  • 08Готовность к быстрому освоению технологий экосистемы Hadoop/Spark
  • 09Навыки самостоятельного поиска информации и решения технических задач
  • 10Опыт использования LLM-агентов и AI-ассистентов (например, Cursor, Claude Code) для генерации, рефакторинга и отладки инженерного кода
Data Engineer (Стажер) · Rekru