tgindex
SysAdmin_jobs

Обсуждаем вакансии и все с ними связанное. Оформить и предложить вакансию можно тут: @cyberJohnny Реклама - @cyberJohnny Чат: https://t.me/+GV-1GAi3F2o1OTMy

Последний пост
16:29
Последнее чтение
21:07
Постов за неделю
5
Всего постов
126
Тип
открытый
Язык
русский
Категория
Карьера
В каталоге с
12 авг.
Подписчики
448
−1 за 5 дн.
Сутки
−1
−0,22%
Неделя
 
Месяц
 
Просмотров на пост
44
40 постов
Вовлечённость
9,8%
к подписчикам
Постов в день
0,7
всего 126
Упоминаний
2
каналов
Охват размещения
оценка
1/24сутки в ленте
23
1/48двое суток
26
1/72трое суток
28

Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.

Посты

  • #senior #офис #москва Bell Integrator MLOps Engineer/Solution Architect Опыт работы: от 3-4 лет Формат работы: гибрид (Москва, Вавилова 19) Ищем талантливого MLOps Engineer/Solution Architect для проектирования и разработки интеграционных решений в крупный банк РФ. Команда отвечает за AI-инициативы бизнеса в сфере глобальных рынков, решает Data Science задачи с применением ML/DL алгоритмов — от бустинга и ансамблей моделей до больших языковых моделей (LLM). ☑️ Чем предстоит заниматься -Совместно с Data Scientist и Product Owner выявлять требования в архитектурных / интеграционных решениях для разрабатываемых приложений -Декомпозировать и документировать требования -Совместно с корпоративными архитекторами, экспертами кибербезопасности и командой сопровождения выбирать технические компоненты и проектировать интеграционные решения -Разрабатывать интеграционные решения и шаблоны кода для масштабирования и стандартизации процесса разработки и вывода в продакшн -Проектировать и развивать концептуальную архитектуру платформы и инфраструктуры приложений ☑️ Наши пожелания к кандидатам -Опыт работы от 3-4 лет, опыт промышленной разработки на Python -Опыт работы с популярными РСУБД (Greenplum, Teradata, Oracle, PostgreSQL) -Опыт интеграции продуктов экосистемы Hadoop (HDFS, Hive, Spark) -Опыт синхронной, асинхронной интеграции сервисов и брокеров сообщений (Kafka, RabbitMQ) -Опыт проектирования CI/CD решений на базе Jenkins и Bitbucket/Git Контакты: hr@bellintegrator.ru (mailto:hr@bellintegrator.ru) / Telegram @bellintegrator_career 🔥 / / @SysAdmins_jobs

  • Data Engineer в Корпоративное хранилище #удаленка Компания: Wildberries 🔹Что нужно делать -Обеспечивать стабильную, производительную и безопасную работу Data Platfrorm на базе Trino, Spark, S3 и Apache Iceberg, включая администрирование и управление ролевой моделью доступа, документирование изменений в проекте -Настраивать, обновлять, мониторить и тюнить кластера Trino -Настраивать коннекторы (Iceberg, S3) -Оптимизировать производительность запросов (resource groups, query analysis) -Оптимизировать производительность Iceberg (partitioning, clustering, metadata management) -Разрабатывать и внедрять централизованные ролевые модели для доступа к данным и ресурсам платформы 🔹Какой опыт и знания нужны -Обладаете пониманием взаимодействия Spark с Iceberg и S3 -Имеете опыт эксплуатации Apache Iceberg (администрирование таблиц в формате Iceberg, настройка и использование Hive Metastore) -Обладаете пониманием и применением: compaction, expiration snapshots, time travel, schema evolution -Имеете навыки Linux, Bash, Python для автоматизации -Обладаете опытом управления политиками доступа и правами доступа через Ranger в S3 и Iceberg -Имеете опыт разработки и внедрения централизованной ролевой модели для доступа к данным и ресурсам платформы -Иметь опыт администрирования Greenplum или ClickHouse (установка, настройка, оптимизация, интеграция с S3/Iceberg). Откликнуться (https://career.rwb.ru/vacancies/28976?) Python Job (https://t.me/job_python) | (https://vk.com/job_python) | (https://max.ru/job_python) @SysAdmins_jobs

  • Дата- инженер #удаленка Компания: Альфа-Банк 🔹Чем предстоит заниматься зСопровождение и анализ существующих процессов загрузки данных ETL -Мониторинг процессов загрузки и выявление аномалий -Приемка миграции существующих процессов загрузки с Oracle на Greenplum -Тестирование и установка доработок в продуктивный контур -Разбор обращений пользователей в рамках компетенций второй линии поддержки -Проверка технической документации 🔹Наши пожелания к кандидатам -Оконченное высшее образование -Опыт работы от 2х лет -Языки программирования: SQL -Технологический стек: Oracle, Greenplum, Apache Spark, ApacheAirflow, Kafka -Навыки работы с: Jira + Confluence или аналогичное, Git, CI/CD, XML, JSON -Навыки системного анализа, тестирования Откликнуться (https://job.alfabank.ru/vacancies/moskva/remote-job/data--inzhener_37423?businessLine=1018) () | () | () @SysAdmins_jobs

  • Data-инженер в команду SQL-SWAT #удаленка Компания: Авито ☑️Какие задачи вас ждут: -разрабатывать сервисы, CLI-инструменты и LLM-инструменты для ускорения и упрощения процесса миграции; -самостоятельно мигрировать объекты с помощью созданных инструментов: -транслировать код; -верифицировать данные; -переносить историю; -переключать зависимости; -обучать и поддерживать пользователей при работе с селф-сервис-инструментами автоматизированной миграции; -в рамках регулярных дежурств поддерживать пользователей в чатах и консультировать по вопросам работы с витринами данных; -мигрировать сложные и критичные витрины данных на новую платформу с сохранением производительности и соблюдением SLA; -улучшать существующие инструменты с применением современных технологий, например AI-элементов для ускорения процессов; -взаимодействовать с владельцами витрин из аналитических команд, согласовывать допустимые расхождения в данных и необходимые изменения бизнес-логики. ☑️Примеры будущих задач: -доработать сервис трансляции SQL-кода, чтобы ускорить трансляцию на 20%; -создать LLM-инструменты для верификации данных во время миграции на локальной машине пользователя; -мигрировать сложные MERGE REFRESH-витрины с учётом специфики Trino и деградацией времени ежедневного расчёта не более чем на 10%; -оптимизировать витрины на Trino, чтобы снизить потребление вычислительных ресурсов на 20%; -ответить на вопрос пользователя в чате, например о том, почему витрина не проходит тесты на производительность. Откликнуться (https://career.avito.com/vacancies/razrabotka/20056/) 🔥 / / @SysAdmins_jobs

  • Стажер Data Engineer в Аналитика Datagovernance [Big Data, МТС Веб Сервисы] #гибрид #intern Москва Компания: МТС 🔹Чем предстоит заниматься -Разрабатывать ETL-процедуры для сервисов datagov с использованием python, pyspark, hadoop, airflow; -Собирать данные из разных реляционных и нереляционных источников; -Создавать наполнять витрины в hive/postgres/clickhouse/greenplum 🔹Что мы ожидаем -Студенты 3 - 6 курсов бакалавриата, специалитета или магистратуры; -Хорошее знание Python; -Уверенное знание SQL и умение работать с реляционной СУБД -Будет плюсом: опыт использования с фреймворками обработки данных типа pandas/polars/spark и подобными Откликнуться (https://job.mts.ru/vacancy/676711284363755935) () | () | () @SysAdmins_jobs

  • 11 авг.44удалён 07:58

    🔥 Приглашаем на бесплатный открытый вебинар курса «Менеджер поставки ИТ-решений / Delivery Manager»: «Метрики Delivery Manager: что измерять, а что – пустая трата времени» 🗓 Когда: 19 августа, 20:00 (мск) Многие Delivery Manager’ы тонут в отчётах и KPI, но реального контроля над поставкой так и не получают. На вебинаре разберём, какие метрики действительно работают, а какие только создают видимость контроля. Что будет: - Какие метрики показывают реальное состояние поставки - Как оценивать предсказуемость, скорость и качество работы команды - Какие показатели помогают видеть риски заранее - Какие метрики чаще всего вводят в заблуждение - Как использовать данные для принятия управленческих решений и общения со стейкхолдерами В результате вы: - Научитесь выбирать действительно полезные показатели для команды и проекта - Сможете выстроить прозрачную систему контроля без лишней бюрократии - Узнаете, как использовать метрики для timely принятия решений и снижения рисков 👉 Зарегистрируйтесь https://vk.cc/d0nDxb Бесплатное занятие приурочено к старту курса «Менеджер поставки ИТ-решений / Delivery Manager», на котором вы научитесь управлять большими командами, портфелями проектов и выстраивать эффективные процессы поставки. Реклама. ООО «Отус онлайн-образование», ОГРН 1177746618576

  • Data Engineer #удаленка #senior Компания: BGStaff ☑️Ключевые задачи -Проектирование, разработка и сопровождение ETL/ELT-пайплайнов с использованием Snowflake и SQL -Управление облачной инфраструктурой на AWS (S3, Glue, Lambda, CloudWatch, IAM) -Написание чистого и поддерживаемого кода на Python -Автоматизация развертывания и настройки инфраструктуры через Terraform -Оркестрация рабочих процессов с помощью Apache Airflow -Мониторинг и устранение неполадок в пайплайнах, контроль качества данных и производительности систем -Совместная работа с дата-сайентистами, аналитиками и разработчиками для создания масштабируемых решений ☑️Обязательные требования -5+ лет коммерческого опыта в Data Engineering или смежных областях -Глубокие знания Snowflake и продвинутый уровень владения SQL -Реальный опыт работы с AWS (S3, Glue, Lambda, CloudWatch, IAM) -Уверенное владение Python для обработки данных и автоматизации -Практический опыт использования Terraform (инфраструктура как код) -Опыт работы с Apache Airflow для оркестрации пайплайнов -Отличные коммуникативные навыки и английский язык уровня C1 -Способность работать самостоятельно в распределённой команде ☑️Будет плюсом -Опыт интеграции и разработки REST API -Знание CircleCI или других CI/CD-инструментов -Опыт работы в полностью удалённых международных командах -Понимание принципов управления данными и безопасности Локация: Удалённо (предпочтительно за пределами РФ и РБ, желательно страны Латинской Америки или Канада) График работы: по восточному времени США (EST) до 17:00, с привязкой к американскому рабочему календарю. Уровень английского языка: C1 (продвинутый профессиональный) Контакты: promo@bgstaff.ru (mailto:promo@bgstaff.ru) Python Job (https://t.me/job_python) | (https://vk.com/job_python) | (https://max.ru/job_python) @SysAdmins_jobs

  • Data Engineer #гибрид Москва Компания: Облако.ру 🔹ОБЯЗАННОСТИ -Проектирование и развитие data-пайплайнов для обработки событий кибербезопасности; -Нормализация и обогащение событий безопасности; -Проектирование и оптимизация аналитического хранилища данных (ClickHouse / StarRocks / аналоги); -Подготовка витрин данных под быстрые запросы и аналитику; -Эксплуатация data сервисов в Kubernetes: деплой, ресурсы, отказоустойчивость, масштабирование; -Обеспечение наблюдаемости и качества данных (метрики, алерты, replay/backfill); -Участие в разборе инцидентов и оптимизации производительности data платформы.  🔹ТРЕБОВАНИЯ -Опыт построения с нуля DWH или Data lake. -Опыт построения и эксплуатации data pipelines (ETL, ELT и/или streaming) в production среде; -Уверенный SQL, включая оптимизацию запросов и анализ производительности; -Опыт работы с OLAP-СУБД (ClickHouse/StarRocks/Druid/Pinot или аналоги); -Понимание принципов потоковой обработки данных (идемпотентность, дедупликация, обработка ошибок); -Опыт проектирования и оптимизации витрин и схем хранения данных; -Уверенные знания Kubernetes и опыт эксплуатации сервисов в production среде; -Понимание принципов надежности, масштабирования и наблюдаемости data систем. Откликнуться (https://cloud.ru/career/vacancies/4052666) 🔥 / / @SysAdmins_jobs

  • Data Engineer в команду SMT #удаленка Компания: 2ГИС 🔹Что предстоит делать -Разрабатывать с нуля MVP новой дата‑платформы и инфраструктуры для ingest/transform. -Мигрировать существующие пайплайны с Hadoop/HDFS на новую архитектуру (S3, Kafka, Spark, ClickHouse). -Работать с большими объёмами данных и высоконагруженными Kafka‑топиками. -Строить отказоустойчивые пайплайны обработки и доставки данных. -Участвовать в архитектурных решениях, внедрять best practices хранения, мониторинга и качества данных. -Проектировать витрины данных под продуктовую и управленческую аналитику (OLAP). -Сопровождать миграцию BI‑отчётов на новую платформу (например, DataLens, Power BI). Откликнуться (https://job.2gis.ru/vacancies/data_science_ai/161) 🔥 / / @SysAdmins_jobs

  • Data Engineer, Подготовка офлайн-факторов ранжирования #удаленка #middle Компания: OZON ☑️Примеры задач -Подготовка витрин и датасетов для команд, аналитики, DS и ML. -Оптимизация Spark-задач, SQL-запросов и процессов поставки данных. Настройка регулярных процессов подготовки витрин данных и контроль их качества. -Разбор инцидентов в процессах подготовки витрин и повышение их надежности. ☑️Нам важно -Опыт разработки пайплайнов обработки данных от 2х лет. -Уверенное владение Python и SQL. -Опыт работы с PySpark/Spark или готовность быстро погрузиться. -Опыт работы с Airflow или другими системами оркестрации обработки данных. Умение разбираться в существующем коде и улучшать его качество. Внимательность к надежности, производительности и мониторингу. Откликнуться (https://ozon.tech/vacancies/dbcb2ac8-0df9-470d-a117-d840990a6eca-data-engineer-podgotovka-oflain-faktorov-ranzhirovaniia/) () | () | () @SysAdmins_jobs

  • Data Engineer #удаленка Компания: Авиасейлс 🔹Что нужно делать -активно участвовать в командном чате: отслеживать запросы, оперативно реагировать на вопросы и задачи в рабочее время; -мониторить системы и решать возникающие инциденты вместе с дежурными дата инженерами; -оптимизировать текущие процессы обработки данных; -модернизировать текущую дата платформу вместе с Core командой дата инженеров. 🔹Чего ждём от тебя -опыт работы инженером данных от 1 года; -знание языков программирования: Python/SQL (обязательно), опыт работы с другими языками будет плюсом. -понимание принципов ETL/ELT процессов и опыт работы с инструментами -понимание как работают распределенные вычисления -опыт работы в нашем стеке Apache Spark, Apache Airflow, DBT, Trino будет плюсом; -самостоятельность и ответственность, умение коммуницировать с разными командами и людьми желание развиваться и выстраивать процессы вокруг себя. Откликнуться (https://www.aviasales.ru/about/vacancies/4287093) 🔥 (https://max.ru/job_python) / / @SysAdmins_jobs

  • Data Engineer в Корпоративное хранилище #удаленка Компания: Wildberries 🔹Что нужно делать -Обеспечивать стабильную, производительную и безопасную работу Data Platfrorm на базе Trino, Spark, S3 и Apache Iceberg, включая администрирование и управление ролевой моделью доступа, документирование изменений в проекте -Настраивать, обновлять, мониторить и тюнить кластера Trino -Настраивать коннекторы (Iceberg, S3) -Оптимизировать производительность запросов (resource groups, query analysis) -Оптимизировать производительность Iceberg (partitioning, clustering, metadata management) -Разрабатывать и внедрять централизованные ролевые модели для доступа к данным и ресурсам платформы 🔹Какой опыт и знания нужны -Обладаете пониманием взаимодействия Spark с Iceberg и S3 -Имеете опыт эксплуатации Apache Iceberg (администрирование таблиц в формате Iceberg, настройка и использование Hive Metastore) -Обладаете пониманием и применением: compaction, expiration snapshots, time travel, schema evolution -Имеете навыки Linux, Bash, Python для автоматизации -Обладаете опытом управления политиками доступа и правами доступа через Ranger в S3 и Iceberg -Имеете опыт разработки и внедрения централизованной ролевой модели для доступа к данным и ресурсам платформы -Иметь опыт администрирования Greenplum или ClickHouse (установка, настройка, оптимизация, интеграция с S3/Iceberg). Откликнуться (https://career.rwb.ru/vacancies/28976?) Python Job (https://t.me/job_python) | (https://vk.com/job_python) | (https://max.ru/job_python) @SysAdmins_jobs

  • 🚀 Вакансия: Data Engineer (удаленно/гибрид) Компания: ООО "ОДСС" https://odsscompany.ru (аккредитованная IT-компания) Локация Москва Зрплата от 150 до 170 т.р. Оформление по ТК РФ Мы ищем в свою команду инициативного Data Engineer для разработки и поддержания инфраструктуры данных для большого проекта озера данных, включающего себя сложные сценарии приема и обработки данных из разных источников. Что предстоит: • разработка и поддержание парсеров • автоматизация обработки и преобразования данных • отладка и мониторинг конвейеров данных Технологический стек: Python, PostgreSQL, Dagster, Selenium Что мы ждем от тебя: - знание основных библиотек Python для работы с данными - опыт обработки и скрейпинга/парсинга сложных и слабоструктурированных документов в форматах pdf, doc, docx, xls, xlsx - опыт работы автоматизации конвейеров данных и знание соответствующих программных инструментов - представление об управлении качеством данных - представление о возможностях отладки мониторинга - понимание специфики форматов данных (JSON lines, Parquet, XML, CSV и тд.) - понимание методов получения и поставки данных (как, например, S3, REST API, SOAP, RPC) - знание английского языка на уровне, достаточном для чтения технической документации - знание Git - готовность осваивать новые технологии и разрабатывать индивидуальные технические решения под поставленные задачи. Плюсами будут: - опыт работы с данными из открытых источников и понимание их специфики - опыт долгосрочного поддержания работы парсеров - опыт работы с библиотеками Python для computer vision Преимущества проекта ✅ Проект только стартовал — мало легаси, много свободы для экспериментов ✅ Можно влиять на выбор технологий и архитектурных решений Для быстрой связи @LvovaOV @SysAdmins_jobs

  • Data Engineer в команду CDP #удаленка Компания: 2Гис 🔹Тебе предстоит -Повысить эффективность пайплайнов для расчета с daily-признаков на основе batch процессинга. -Создать эффективный пайплайн для расчёта realtime-признаков на основе Kafka‑топиков. -Проектировать и разрабатывать сервисы, обрабатывающие миллиарды событий пользователей. -Решать сложные инженерные задачи: расчеты метрик, построение витрин. -Работать с потоками данных и интеграциями между CDP и другими системами 2ГИС. -Влиять на архитектурные решения и качество кода. -Работать в распределенной команде, взаимодействуя с аналитиками, продактами и инженерами других направлений. 🔹Ждем от тебя -Опыт работы с highload-системами. -Опыт проектирования архитектуры данных или платформенного кода. -Опыт работы с Kafka, ClickHouse или другими системами потоковой и аналитической обработки данных. Хорошо понимает, как работает Spark и умеет его готовить. Хорошо владеешь одним из языков программирования (например, Python или Scala). -Самостоятельность и проактивность — ты не ждешь постановок, а предлагаешь решения. -Желание разбираться в бизнес-логике и создавать продукт, а не просто писать код. Откликнуться (https://job.2gis.ru/vacancies/data_science_ai/304) () | () | () @SysAdmins_jobs

  • Инженер данных #гибрид Москва Компания: Альфа-Банк 🔹Чем предстоит заниматься -Реализация высоконагруженных конвейеров обработки данных для обеспечения надежной и бесперебойной репликации данных из ИТ-систем Банка. -Реализация комплексных задач по подготовке данных в целевых аналитических хранилищах (DataLake, SandBox, FeatureStore) для построения признаков, необходимых для разработки моделей машинного обучения. -Разработка и поддержание в актуальном состоянии документации по разработанному функционалу. -Своевременное отражение статуса выполнения задач в Jira. -Проверка качества кода (код-ревью), написанного инженерами и младшими инженерами данных. 🔹Наши пожелания к кандидатам -Python - уверенное знание структур данных и алгоритмов, эффективное применение принципов ООП и ФП (Функциональное программирование), опыт написания модульных и интеграционных тестов, знание и опыт применения библиотек обработки и анализа данных - numpy, pandas. -Опыт разработки и внедрения в промышленную эксплуатацию сервисов загрузки и обработки неструктурированных и слабо структурированных данных (текст, xml, json) из внешних источников. -Способность разобраться с API поставщиков данных, используя доступную документацию. -SQL - умение создавать сложные запросы с использованием аналитических оконных функций и использовать инструменты профилирования для оптимизации их производительности, опыт работы с БД Oracle, Postgres, Greenplum. -Уверенное знание и опыт работы с инструментами разработки, планирования и мониторинга рабочих процессов (workflow engines) пакетной обработки данных. -Airflow- Опыт разработки сложных, высоконагруженных приложений обработки данных на основе PySpark, уверенное знание настроек Spark и их влияния на производительность приложений Spark. Откликнуться (https://job.alfabank.ru/vacancies/moskva/remote-job/inzhener-dannyikh_35029?text=data) 🔥 / / @SysAdmins_jobs

  • Data Engineer #удаленка Компания: Авиасейлс 🔹Что нужно делать -активно участвовать в командном чате: отслеживать запросы, оперативно реагировать на вопросы и задачи в рабочее время; -мониторить системы и решать возникающие инциденты вместе с дежурными дата инженерами; -оптимизировать текущие процессы обработки данных; -модернизировать текущую дата платформу вместе с Core командой дата инженеров. 🔹Чего ждём от тебя -опыт работы инженером данных от 1 года; -знание языков программирования: Python/SQL (обязательно), опыт работы с другими языками будет плюсом. -понимание принципов ETL/ELT процессов и опыт работы с инструментами -понимание как работают распределенные вычисления -опыт работы в нашем стеке Apache Spark, Apache Airflow, DBT, Trino будет плюсом; -самостоятельность и ответственность, умение коммуницировать с разными командами и людьми желание развиваться и выстраивать процессы вокруг себя. Откликнуться (https://www.aviasales.ru/about/vacancies/4287093) @SysAdmins_jobs

  • Data Engineer в команду Spark #удаленка Компания: Авито 🔹Какие задачи вас ждут: -разрабатывать новые и поддерживать существующие продукты в составе кросс-функциональной команды; -развивать существующую Big Data-платформу с учётом растущей нагрузки от новых задач и данных: 90% задач связаны со Spark; -создавать новые сервисы на Python и улучшать существующие; -внедрять инженерные практики и делиться с командой своим опытом; -предлагать новые подходы и быстро проверять их в продакшене на реальных данных. 🔹Мы ждем, что вы: -пишете на Python или Java/Scala и готовы перейти на Python; -глубоко понимаете экосистему Hadoop/Spark/Hive и связанные продукты; -работали с данными и решали аналитические задачи; -умеете администрировать Linux-системы на базовом уровне; -готовы искать нестандартные решения. Откликнуться (https://career.avito.com/vacancies/razrabotka/20034/) 🔥 / / @SysAdmins_jobs

  • Data Engineer/ MLOpsE #офис #гибрид #middle Москва Компания: Bell Integrator ☑️ЧТО МЫ ОЖИДАЕМ ОТ КАНДИДАТА: -Понимание основ облачных технологий и технологий виртуализации и контейнеризации; -Опыт с экосистемой Hadoop (HDFS, Hive, Spark и п-р.); -Опыт промышленной разработки Python; -Опыт работы с ETL (Airflow и пр.); -Опыт работы с CI/CD решениями на базе Jenkins и Bitbucket / Git. БУДЕТ ПЛЮСОМ: Опыт работы с платформами оркестрации контейнеров K8s, OpenShift; Опыт внедрения DS-моделей в промышленный контур; Опыт работы с Kafka; Опыт работы с популярными РСУБД (Greenplum, Teradata, Oracle, PostgreSQL); Понимание принципов построения хранилищ данных DWH; Знания в RL и Графовых нейросетях; Отличные знания в области классического ML и DL. ☑️ЧЕМ ПРЕДСТОИТ ЗАНИМАТЬСЯ: -Разработка, поддержка и оптимизация ETL-процессов команды на платформах банка; -Внедрение разработанных DS-моделей в промышленную среду (MLOps); -Поддержка промышленной эксплуатации разработанных решений. ☑️МЫ ПРЕДЛАГАЕМ: -Возможность участия в интересных проектах. -Возможность профессионального и карьерного роста в компании. -Опыт работы в команде профессионалов. -Специальные тарифы для сотрудников в спортивные клубы и языковые курсы и пр. -Офисный\гибридный формат работы в Москве. Контакты: hr@bellintegrator.ru (mailto:hr@bellintegrator.ru) () | () | () @SysAdmins_jobs

  • Data Engineer в команду CDP #удаленка Компания: 2Гис 🔹Тебе предстоит -Повысить эффективность пайплайнов для расчета с daily-признаков на основе batch процессинга. -Создать эффективный пайплайн для расчёта realtime-признаков на основе Kafka‑топиков. -Проектировать и разрабатывать сервисы, обрабатывающие миллиарды событий пользователей. -Решать сложные инженерные задачи: расчеты метрик, построение витрин. -Работать с потоками данных и интеграциями между CDP и другими системами 2ГИС. -Влиять на архитектурные решения и качество кода. -Работать в распределенной команде, взаимодействуя с аналитиками, продактами и инженерами других направлений. 🔹Ждем от тебя -Опыт работы с highload-системами. -Опыт проектирования архитектуры данных или платформенного кода. -Опыт работы с Kafka, ClickHouse или другими системами потоковой и аналитической обработки данных. Хорошо понимает, как работает Spark и умеет его готовить. Хорошо владеешь одним из языков программирования (например, Python или Scala). -Самостоятельность и проактивность — ты не ждешь постановок, а предлагаешь решения. -Желание разбираться в бизнес-логике и создавать продукт, а не просто писать код. Откликнуться (https://job.2gis.ru/vacancies/data_science_ai/304) () | () | () @SysAdmins_jobs

  • Ведущий инженер данных Видео, Москва #удаленка #senior Компания:VK 🔹Задачи -Разрабатывать и поддерживать процессы обработки и доставки данных для аналитических и ML команд -Собирать витрины, оптимизировать -Писать адхоки и выгрузки, раздебаги -Собирать требования 🔹Требования -Понимание работы параллельных вычислений на кластере -Опыт с Airflow, Spark, Hadoop, ClickHouse, YT (опционально) -Знание Python: алгосы базовые (для понимания оптимального кода), классы и прочий сложный код (для чтения исходников и создания велосипедов типа операторов/сервисов) -Знание Git и работа с кодом в команде (ревью) Откликнуться (https://team.vk.company/vacancy/45275/) 🔥 / / @SysAdmins_jobs