Senior Backend Engineer (High‑Load)

Summary

Senior backend engineer building a global aggregator platform for motorcycle parts (500M+ records, 500+ manufacturers). You'll design ETL pipelines, normalize data from multiple sources, work with PlanetScale/MySQL on AWS, and migrate code from Node.js to Bun.js.

Компания Emphasoft занимается заказной разработкой IT решений для наших партнеров с западного рынка. Мы специализируемся на разработке web-приложений для стартапов на различной стадии.

О проекте

Мы строим глобальную платформу‑агрегатор для рынка мотоциклетных запчастей. Платформа объединяет 500+ производителей, тысячи дистрибьюторов и миллионы SKU в едином каталоге. Мы уже обрабатываем 500 миллионов записей о деталях, их совместимости и ценах — и это число растет каждый день.

Стек: Bun.js / Node.js · TypeScript · PlanetScale (MySQL) · AWS · ETL

Задача

Данные поступают из множества источников:

  • REST / GraphQL API

  • FTP‑серверы

  • Парсинг сайтов

  • CSV / Excel‑файлы

  • Прямые подключения к базам данных поставщиков

Наша ключевая задача — нормализовать, дедуплицировать и сопоставить эти данные, чтобы точно определить, например, что «вот этот болт подходит к конкретной модели мотоцикла».
Это сложная инженерная задача на стыке ETL, Big Data, алгоритмов матчинга и высоконагруженных систем.

Что предстоит делать

  • Проектировать и развивать ETL‑пайплайны — от приёма сырых данных до нормализации и выдачи в поиск.

  • Строить надёжные интеграции с API, FTP, парсерами, выгрузками из БД.

  • Работать с PlanetScale (MySQL‑совместимая распределённая БД) на масштабе 500M+ записей.

  • Улучшать качество данных — разрабатывать алгоритмы дедупликации, матчинга и разрешения сущностей.

  • Мигрировать существующий код с Node.js на Bun.js — переписывать критичные компоненты на современный рантайм для повышения производительности.

  • Рефакторить и улучшать архитектуру кода, внедрять тесты и паттерны.

  • Принимать ключевые технические решения и обсуждать приоритеты напрямую с основателями.

Мы ищем

Нам не важен конкретный язык, если вы работали с высоконагруженными системами и большими данными. Важен опыт в масштабных ETL‑задачах и понимание того, как строить системы на миллионы/миллиарды записей.

Обязательно:

  • Опыт работы с большими данными — минимум 5 лет коммерческой разработки в области ETL / Data Engineering / Backend на высоконагруженных системах.

  • Опыт работы в крупных маркетплейсах (Ozon, Wildberries, Avito, Lamoda, Яндекс.Маркет, AliExpress, Amazon и т.п.) — вы точно знаете, что такое масштаб, каталоги, инвентарь, поиск и высокая нагрузка.

  • Глубокий опыт с реляционными БД на масштабе (PlanetScale / MySQL / Vitess / аналоги) — моделирование данных, индексы, оптимизация запросов.

  • Опыт построения ETL / пайплайнов данных (приём, трансформация, дедупликация).

  • Уверенная работа с AWS (EC2, RDS, S3, Lambda и др.).

  • Опыт с IaC (SST, CDK или Terraform — у нас SST).

  • Самостоятельность, умение работать в быстром темпе, минимальный менеджмент.

  • Английский Upper‑Intermediate и выше (работа в международной команде).

Будет плюсом:

  • Знание Node.js / TypeScript (поможет на этапе миграции).

  • Опыт с Bun.js (мы переходим на него).

  • Опыт с веб‑парсингом (Puppeteer, Playwright, Cheerio).

  • Знакомство с fuzzy matching / ML‑методами для матчинга данных.

  • Опыт с поисковыми движками (Elasticsearch, Algolia, Meilisearch).

  • Работа с Kafka или очередями сообщений для событийных пайплайнов.

Условия

  • Полностью удаленная работа.

  • Гибкий график.

  • Прямое влияние на архитектуру и продукт.

  • Минимум бюрократии и микроменеджмента.

See also

要針對這個職缺調整履歷嗎?

目前無法檢查您與這個職缺的符合程度;請先將履歷加入個人檔案,下次即可查看。

A new version of freehire is available