Data Engineer
Мы ищем data engineer для управления слоем метрик: единым источником истины для всех бизнес-показателей. Метрики рассчитываются на SQL в хранилище и отдаются в Power BI.
Это бэкенд-роль: ваша задача — обеспечить единую формулу для каждого термина, определенную один раз и используемую везде.
Задачи:
- Проектирование и поддержка SQL-слоя метрик.
- Обеспечение единой канонической формулы для каждой метрики (без дублирования).
- Моделирование измерений и таблиц фактов для корректной фильтрации в Power BI.
- Композиционное построение метрик (аддитивные базы + производные) для корректной агрегации при любом группировании.
- Governance: стандарты, ревью, тесты, документация и удобные процессы для новых разработчиков.
- Определение политики разграничения вычислений на SQL и в Power BI/DAX.
- Оптимизация производительности и затрат (материализация, инкрементальные сборки, партицирование).
Must have:
- Отличный SQL (понимание зерна агрегации и аддитивности).
- Опыт работы с Redshift и Databricks.
- Опыт интеграции с Power BI (понимание моделей, связей и места DAX).
- Размерностное моделирование (схемы «звезда», согласованные измерения, SCD, суррогатные ключи).
- Знание принципов семантического слоя (dbt, Cube, LookML). Инструменты не закупаются, но нужно уметь реализовать их гарантии на чистом SQL.
- Навыки governance и организации совместной работы без дублирования схем.
- Уровень владения английским не ниже В1
Strongly preferred:
- Python (трансформации, автоматизация).
- TypeScript (внутренние инструменты).
Nice to have:
- Знание DAX (для грамотного разграничения с SQL).
- Оркестрация (Airflow/Dagster).
- Дизайн row-level security.