• Войти
Работа в Москве
наверх
Создать резюме
Подбор персонала

Более 150 000 компаний ждут Ваше резюме

Войти Для работодателей
Работа в Москве
наверх
  1. Работа в Москве
  2. ⚫ Инженер ✔
  3. Вакансии в Москве
sync disabled Вакансия в архиве с 18.05.2026
Найти похожие вакансии

Big Data Engineer (NRT/Spark)

Яндекс
Яндекс

Город:

Москва

Занятость:

Полная занятость

Компания "Яндекс"

Описание проекта

Финтех в Яндексе — это одно из ключевых и наиболее динамично развивающихся направлений компании. Это экосистема финансовых сервисов, встроенная в повседневную жизнь миллионов пользователей и бизнесов.

Это молодое, смелое направление, которое уже доказало свою пользу и продолжает активно расти.

Ключевые продукты Финтеха Яндекса: Яндекс Пэй, Сплит, Сейвы, Карта Плюса, Кредитные продукты, Яндекс ID, Яндекс Про и многое другое

Это сложная инженерная и аналитическая среда, где пересекаются хайлоад, большие данные и жёсткие требования регуляторов.

Здесь ты столкнёшься с:

  • Высокими нагрузками: Миллионы транзакций, таблицы с объёмом далеко за 1 млн записей
  • Распределёнными данными: Используются Greenplum, ClickHouse, Hadoop, Spark для обработки огромных массивов информации
  • Архитектурой DWH: Строятся сложные хранилища данных, витрины для отчётности (регуляторной и управленческой), настраиваются ETL-процессы
  • Безопасностью и интеграцией: Проработка интеграций с внешними источниками (БКИ, СМЭВ), автоматизация ручных процессов бэк-офиса, работа с автоматизированными банковскими системам

В команду платформенных данных требуется специалист по Apache Spark с глубоким понимаем внутренней архитектуры фреймворка. Основная задача - развитие платформы для обработки NRT- данных (near real time), повышение отказоуйсточивости и производительности потоковых процессов.

Какие задачи вас ждут:

  • Проектирование и развитие облачной data-платформы
    Оптимизация текущей инфраструктуры и проектирование новых компонентов платформы с использованием облачных технологий Yandex Cloud. Готовимся к кратному росту объемов обрабатываемых данных.

  • Миграция с GreenPlum на Trino / S3
    Переход с дорогостоящего в поддержке и эксплуатации Greenplum на доступ к данным в S3 через Trino. Используем современные технологии для быстрого доступа к данным в основном хранилище.

  • Построение единой observability-платформы для таблиц DWH
    Создание единой точки входа для мониторинга статусов сборки, качества данных и анализа зависимостей, включая построение datalineage и процессы логирования. Обеспечиваем наблюдаемость и контролируемость процессов.

  • Ускорение текущих процессов поставки данных
    Оптимизация существующих и построение новых надежных процессов поставки данных, включая процессы взятия снепшотов, загрузки инкрементов напрямую, из аудит-таблиц и CDC, а также внедрение Spark Streaming или аналогичных решений для обеспечения near-real-time обновления данных. Ускоряем обработку растущих потоков данных.

  • Автоматизация ручных процессов
    Построение CI/CD пайплайнов для автоматизации процессов развертывания инфраструктуры, построения новых интеграций. Отадем рутину автоматике.

  • Повышение безопасности доступа к данным
    Выстраивание процессов автоматической выдачи и контроля доступов во всех системах, включая доступ к инфраструктуре, данным и аудит действий пользователей. Обеспечиваем безопасный и контролируемый доступ к банковским данным.

  • Построение тестовых окружений
    Создание изолированных сред разработки, тестирования и предпрод с автоматизированными процессами тестирования. Выстраиваем среду безопасной разработки и повышаем надежность разрабатываемых решений

  • Развитие фреймворков обработки данных
    Развитие внутренних фреймворков для загрузки, трансформации и контроля качества данных. Делаем low-code решения для ускорения разработки.

Ключевые требования

  • Опыт коммерческой разработки от 4 лет
  • Глубокое понимание устройства БД: оптимизация запросов, планы выполнения, партиционирование, шардирование и индексы
  • Владение разными типами СУБД: PostgreSQL, Oracle, MongoDB, Greenplum
  • Реальный опыт с CDC (Change Data Capture) — понимание принципов и умение реализовывать пайплайны
  • Уверенная работа с S3-совместимыми хранилищами

Стек для ежедневных задач:

  • Языки: Python (основной для разработки пайплайнов и скриптов)
  • Оркестрация: Apache Airflow (разработка пайплайнов)
  • Обработка данных: Apache Spark (Spark SQL, DataFrame)
  • Запросы: Trino (работа с данными через движок)
Похожие вакансии

30 Мая

Senior QA Automation Engineer( Simplenight )

Москва

от 150 000  до 300 000 руб.

Компания "Simplenight" Position: QA Automation Engineer Level: Senior Experience: 8+ years (NOT freelancing) Location: Remote...

Отправить резюме
подробнее

30 Мая

Стажер data science (ИИ в агростраховании)

Москва

Компания "МАЙНДСЭТ" Вакансия: Стажёр по анализу сельскохозяйственных рисков В компанию требуется стажёр по направлению «машинное обучение в...

Отправить резюме
подробнее

30 Мая

Data Scientist (LLM & ML) в команду «История операций» СберБанк Онлайн

Москва

Компания "Сбербанк" О команде и вызове «История операций» — это один из самых высоконагруженных и посещаемых экранов в приложении. Наша цель...

Отправить резюме
подробнее

30 Мая

Руководитель проекта (SberData)

Москва

Компания "Сбербанк" SberData – подразделение Сбера, которое занимается разработкой инфраструктуры для поставки, хранения и обработки данных....

Отправить резюме
подробнее

30 Мая

DevOps / DevSecOps Engineer (проектная работа)

Москва

Компания "Printum" Компания Printum ищет DevOps / DevSecOps инженера для развития процессов безопасной разработки и автоматизации...

Отправить резюме
подробнее
Больше похожих вакансий
Подпишитесь на похожие вакансии

Вакансия размещена в отрасли

Информационные технологии / IT / Интернет:
  • Другое
к поиску вакансий
Популярные специализации
  • Другое
  • Менеджер по продажам
  • Менеджер по работе с клиентами
  • Продавец-консультант
  • Продавец-кассир
  • Администратор
Инструменты соискателя
  • Разместить резюме
  • Найти работу
  • Поиск вакансий
  • Каталог вакансий
  • Соглашение по содействию в трудоустройстве
  • Защита персональных данных
  • Архивный каталог
  • Вакансии по профессиям
  • Поиск по городам
Инструменты работодателя
  • Разместить вакансию
  • Найти сотрудника
  • Поиск резюме
  • Каталог резюме
  • Тарифы
  • Информер с вакансиями
  • Резюме по профессиям
Больше всего ищут
  • Бармен
  • Брокер
  • Водитель такси
  • Корреспондент
  • Охранник
  • Переводчик

© 2007 - 2026 «Карьерист.ру»

  • О нас
  • Обратная связь