SRE&DevOps Job RSS
Статистика[In development] Job opportunities & CV from: @devops_jobs @sre_hamster_job Chats: @sre_hamster_job @sre_hamster_tech Channels: @sre_hamster
- Последний пост
- 04:51
- Последнее чтение
- 08:22
- Постов за неделю
- 54
- Всего постов
- 715
- Тип
- открытый
- Язык
- русский
- Категория
- Технологии
- В каталоге с
- 12 авг.
- 1/24сутки в ленте
- 16
- 1/48двое суток
- 18
- 1/72трое суток
- 19
Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.
Посты
Публикатор: Владислав Обсуждение: @devops_jobs Message that triggered the check: #резюме #resume #devops #sre #kubernetes #aws #terraform #ansible #iac #observability #gitops #vault #linux #remote DevOps-инженер Формат работы: удалённо Занятость: полная, проектная, подработка Оформление: ИП, самозанятый, ГПХ Ожидания: по договорённости DevOps-инженер, 5+ лет в инфраструктуре — от bare-metal и сетевого сегмента on-prem до облачных Kubernetes-платформ и мультиаккаунтного AWS. Работаю с высоконагруженным международным интернет-продуктом: собственная PaaS-платформа на 6 дата-центрах (Frankfurt / Amsterdam), 2 Kubernetes-стека (EKS), 30+ микросервисов, 5 изолированных AWS-аккаунтов, гетерогенный data layer. Чем занимаюсь: — Kubernetes (EKS): эксплуатация продовых кластеров, автоскейлинг нод через Karpenter на спот-инстансах, VPC CNI с prefix delegation, HPA, RBAC, policy-as-code на Kyverno. — Helm и GitOps: разработка и поддержка чартов, единая values-структура по окружениям, стратегии выката. Доставка через ArgoCD и Flux — состояние кластеров в Git, ручные правки исключены. — HashiCorp Vault: централизованное управление секретами, политики доступа, динамические секреты, автоматизированная выдача секретов в фича-окружениях на этапе деплоя. PKI-движок — выпуск и автоматическая ротация внутренних TLS-сертификатов. — IaC: Terraform / OpenTofu / Terragrunt — разработка модулей, миграция между поколениями, разделение общего state между репозиториями, CI/CD для инфраструктурного кода. Ansible для конфигурационного управления. — Данные: отказоустойчивый PostgreSQL на Patroni с автоматическим failover через etcd, Kafka (MSK) — топики, партиционирование, ACL, мониторинг лага консьюмеров. Эксплуатация ClickHouse, MongoDB, RabbitMQ, Redis. — Наблюдаемость: Prometheus, Alertmanager, Grafana, Loki, VictoriaMetrics — метрики, логи, дашборды, алертинг с маршрутизацией по severity. — Incident management: расследование прод-инцидентов, локализация root cause по метрикам и логам, восстановление сервисов, постмортемы. Помощь разработке — ошибки деплоя, rollout-фейлы, отладка пайплайнов, доступы через IRSA / OIDC. — Безопасность: аудит конфигураций AWS Security Hub, устранение избыточных сетевых доступов и публичной экспозиции сервисов. Gateway-слой на Nginx / OpenResty (Lua) — гео-роутинг, редиректы, терминация TLS, allow-list. До этого — 2 года на on-prem: парк из ~300 физических серверов, сетевая сегментация, политики безопасности, автоматизация ввода серверов в эксплуатацию. Стек: Kubernetes (EKS, bare-metal), Helm, Karpenter, Kyverno, Docker, Terraform / OpenTofu, Ansible, GitLab CI/CD, ArgoCD, Flux, AWS (VPC, Transit Gateway, RDS, MSK, IAM/SSO, IRSA), Vault, PostgreSQL / Patroni, Kafka, ClickHouse, MongoDB, Redis, RabbitMQ, Prometheus, Grafana, Loki, VictoriaMetrics, ELK, Nginx / OpenResty, Envoy, Cloudflare, Linux, Bash, Python. Открыт к долгосрочному сотрудничеству, рассматриваю проектную работу и отдельные задачи. TG: @qwertyqwerwe Email: vlad.kostomarov2013@gmail.com
Публикатор: Polli Sss Обсуждение: @devops_jobs #вакансия #vacancy #devops #infrastructure Senior Infrastructure Engineer Сайт компании: trafficstars.com Город: Лимассол, Кипр. Формат работы: офис, фуллтайм. Зп: от 6000 до 7100 евро на руки + годовой бонус Продукт: высоконагруженная рекламная сеть, 10+ лет на международном рынке TrafficStars - рекламная сеть , которая регистрирует свыше 7 млрд событий в сутки в кластер ClickHouse 3,6 петабайт, +500 серверов, расположенных в дата-центрах Европы и США. Наша сеть принимает и обрабатывает в пиковые часы более 1 млн запросов в секунду. Хорошая возможность применить свой опыт и знания в уникальном highload-проекте, в команде отличных специалистов. В связи с ростом IT департамента, мы открываем вакансию на должность Senior Infrastructure Engineer. Вакансия подразумевает релокацию вместе со всей семьей на Кипр, в г. Лимассол, и полное официальное трудоустройство. Задачи: * Развитие и поддержка IT-инфраструктуры в высоконагруженном гео распределенном проекте; * Обеспечение бесперебойной работы инфраструктуры и сервисов; * Сопровождение bare-metal кластеров k8s; * Сопровождение кластеров Clickhouse, Kafka, PostgreSQL, Aerospike; * Автоматизация процессов; * Обнаружение потенциальных проблем и участие в создании решения по их устранению; * Поиск, тестирование и внедрение новых решений, помогающих оптимизировать текущие процессы и повысить качество предоставляемых услуг; Наши ожидания от тебя: * Опыт администрирования Linux серверов; * Опыт администрирования Kubernetes; * Опыт администрирования ClickHouse, PostgreSQL, Redis; * Опыт работы с брокерами сообщений (Kafka); * Понимание принципов IaC; * Prometheus stack; * ELK/EFK; Будет плюсом: *Опыт работы с Aerospike. *Опыт использования GitLab CI. *Опыт автоматизации с помощью Ansible. *Владение любым языком программирования или скриптовым языком (Python, Bash, Go и др.). Мы предлагаем: * Отсутствие дресс-кода и бюрократии; * Рабочий ноутбук на выбор: Mac или PC; * Покупка билетов до Кипра за счёт компании; * Помощь с переездом семьи из любого региона; * Рабочая виза для сотрудника и гостевая виза для членов семьи; * Предоставляем жильё на первый месяц; * Медицинская страховка и мобильная связь; * Бесплатные обеды и напитки; * Всегда полные корзины фруктов и всяких вкусняшек в офисе; * Бесплатные курсы английского и греческого языков; * Оплата занятий спортом; * Частичная оплата школ и детских садов. Пишите: @pollid8
Публикатор: Artem Zhiyanov Обсуждение: @devops_jobs #резюме DevOps / MLOps Engineer Формат: Удаленно Занятость: Проектная / Полная Оформление: ИП / Самозанятый / Договор подряда Ставка: от 1200 час Опыт: 6+ лет Работа в компании бизнес аналитики - 4+ лет 2 Стартапа развитие + поддержка . **Стек:** Kubernetes (Kubeadm, k3s, Rancher), Helm, ArgoCD, GitLab CI AWS, Yandex Cloud — есть опыт миграции между провайдерами без даунтайма Data Engineering: Airflow, Trino, Apache Iceberg, Kafka, ClickHouse, dbt Security & SSO: Keycloak (AD/LDAP), HashiCorp Vault, Cert-manager Observability: Prometheus, Grafana, Alertmanager, Loki, Zabbix БД и стриминг: PostgreSQL, MariaDB, Redis, Kafka MLOps: MLflow, Kubeflow, vLLM **Что делал:** — Развернул с нуля 4 изолированных enterprise-контура и вывел в продуктивную эксплуатацию, включая доставку кода в закрытый контур без интернета — Сократил время релиза с 3 часов до 15 минут через GitOps на ArgoCD — Снизил MTTR на 40% после перехода на IaC и настройки наблюдаемости — Мигрировал production из Yandex Cloud в AWS и из Docker Compose в Kubernetes — без прерывания SLA — Восстановил инфраструктуру после кибератаки за счёт заранее настроенного IaC — Сопровождаю команды 10–20+ разработчиков: онбординг, ревью инфраструктурного кода, консультации по CI/CD и Kubernetes Резюме и подробности — в личку: @sun_solomone
Публикатор: Yana Klapats Обсуждение: @devops_jobs #вакансия #DevOps # Вакансия: Senior DevOps Engineer Локация: РФ Формат работы: удалённо Занятость: полная ЗП : 265000 на руки Оформление : ИП,СЗ Требования (must‑have): 5–7+ лет в DevOps/SRE/системном администрировании; от 3 лет опыта эксплуатации OpenStack в проде (кластеры от 50+ узлов); экспертный уровень Linux, виртуализации и SDN; опыт проектирования и интеграции Ceph; продвинутые навыки в Ansible и Terraform; уверенное владение инструментами мониторинга и SRE‑практиками; опыт работы с Docker, Kubernetes, CI/CD‑пайплайнами; опыт участия в on‑call, разбора P0/P1‑инцидентов, проведения post‑mortem, менторства команды. Стек : OpenStack (Nova, Neutron, Cinder, Keystone и др.) — кластеры от 50+ узлов; Ceph — проектирование, тюнинг, интеграция с Cinder/Glance; Linux (RHEL, Ubuntu, Debian), виртуализация (KVM/QEMU/libvirt), SDN (OVS, OVN, VXLAN, BGP); автоматизация: Ansible (продвинутый уровень), Terraform; контейнеризация и оркестрация: Docker, Kubernetes; CI/CD: GitLab CI, Jenkins и др.; мониторинг и observability: Prometheus, Grafana, VictoriaMetrics, ELK/Loki; SRE‑практики (SLO/SLI, error budgets); чтение кода на Python. Будет плюсом: Ironic, GitOps (ArgoCD/Flux), distributed tracing (Jaeger/Zipkin). Что предстоит делать: эксплуатировать и развивать OpenStack‑кластеры, выполнять миграции; поддерживать высокопроизводительные сети и хранилища (Ceph), диагностировать и устранять инциденты; развивать мониторинг, алертинг, документацию и runbooks; автоматизировать процессы (IaC, CI/CD), внедрять best practices; руководить и менторить коллег, участвовать в on‑call. Отклик: Tг @yanaklapot
Публикатор: Dasha Orlova Обсуждение: @devops_jobs #резюме #devops #middle #sre #remote Позиция: Middle DevOps Engineer / DevOps/SRE Формат работы: Рассматриваю удаленный и гибридный формат Занятость: полная Локация: РФ/РБ/и другие страны Зарплата: по договорённости Обо мне: DevOps-инженер с сильным бэкграундом в системном администрировании и базах данных. Работаю с production-инфраструктурой, CI/CD, Kubernetes, IaC, мониторингом и отказоустойчивыми системами. Путь: Database/System Administrator → Software Developer / Database Engineer → System Engineer / DevOps → DevOps Engineer. Ключевой опыт: — Оптимизировала GitLab CI/CD: время выполнения pipeline сократилось с 30 до 10 минут. — Работала с Kubernetes, Docker, Helm, мигрировала проекты в Argo CD, внедряла GitOps-подход. — Участвовала в переводе монолитного приложения на микросервисную архитектуру. — Автоматизировала инфраструктуру и операционные задачи с помощью Terraform, Ansible/AWX, Bash и Python. — Снизила затраты на облачную инфраструктуру примерно на 50%. — Сокращала downtime при maintenance-работах, выполняла SRE-задачи и участвовала в расследовании production-инцидентов. — Внедряла мониторинг и alerting: Prometheus, Grafana, Alertmanager, Zabbix; работала с ELK/EFK и Loki. — Сопровождала HA PostgreSQL на Patroni + etcd + HAProxy. — Внедрила ClickHouse для разгрузки транзакционной PostgreSQL. — Выполнила upgrade MySQL 5.x → 8 с минимальным downtime. — Сильный DBA-бэкграунд: PostgreSQL, MySQL, Oracle, ClickHouse, Redis; Oracle Data Guard/RAC/ASM/RMAN/Exadata. Работала с обновлением банковских Oracle DB объемом в сотни ТБ. Стек: Linux, Kubernetes, Docker, Helm, Argo CD, Terraform, Ansible/AWX, GitLab CI/CD, Jenkins, AWS, Azure, Yandex Cloud, Hetzner, Prometheus, Grafana, Alertmanager, ELK/EFK, Loki, PostgreSQL, Patroni, etcd, HAProxy, MySQL, ClickHouse, Redis, Oracle, Bash, Python О себе: Ответственно отношусь к задачам, люблю разбираться в сложных технических проблемах и искать их первопричину. Постоянно развиваюсь в DevOps/SRE и стараюсь применять новые знания на практике. Интересны задачи по автоматизации, надежности, Kubernetes, CI/CD и развитию production-инфраструктуры. Telegram: @tosha_louie
Публикатор: Daniil Обсуждение: @devops_jobs #резюме #devops #junior #remote #fulltime Позиция: DevOps Junior+ Формат работы: удалённо Занятость: полная Локация: всё кроме РФ и Беларуси Зарплата: по договорённости Обо мне: IT-инженер с 2+ годами опыта в L1/L2 support, администрировании инфраструктуры и DevOps-инструментах. Сейчас работаю DevOps Engineer в Optimo Group в команде с Senior Devops. с нуля мигрировал CI/CD инфраструктуру и десятки production-сервисов по 6 проектам с GitHub на self-hosted GitLab, построил GitLab CI/CD пайплайны, участвовал в развёртывании Kubernetes-инфраструктуры с GitOps-подходом через ArgoCD. Путь: Junior Systems Administrator → IT Support Engineer L2 → DevOps Engineer. — Мигрировал production-репозитории и сервисы с GitHub на self-hosted GitLab по 6 проектам. — Написал GitLab CI/CD пайплайны с нуля взамен legacy GitHub Actions, используя shared CI-шаблоны для централизованной, переиспользуемой логики пайплайнов на десятках сервисов. — Мигрировал сборку Docker-образов с Jib на Spring Boot Paketo bootBuildImage поверх Podman, привёл сервисы к единому rootless-подходу к сборке контейнеров. — Рефакторил Gradle build-файлы в множестве микросервисов под новую CI/CD инфраструктуру: правки зависимостей, настройка Maven-репозиториев, реструктуризация build-тасок. — Стандартизировал branch-структуру и конфигурацию пайплайнов по всем проектам под единый формат. — Участвовал в построении Kubernetes-инфраструктуры с нуля, включая GitOps-доставку через ArgoCD взамен ручных деплоев. — Работал с Oracle Database в контексте конфигурации и подключения backend-микросервисов. — Убрал захардкоженные credentials из build-конфигов, перенёс их в protected GitLab CI/CD variables в рамках Secret Management инициативы. — Сейчас занимаюсь настройкой RBAC для ArgoCD и Kubernetes (least-privilege access). Также имею опыт: — L1/L2 поддержки через Zendesk/Jira: 30-40 тикетов в день, sub-2h first response SLA — Конфигурации и поддержки платёжных gateway-терминалов, сверки транзакций через прямые SQL-запросы (PostgreSQL) — Поддержки распределённой VPN-инфраструктуры (IPSec, L2TP), диагностики через Wireshark и Zabbix — Проектирования enterprise-сетей на 130+ endpoints: Cisco/MikroTik, VLAN, ACL, inter-VLAN routing — Администрирования Windows Server (AD, GPO, DNS/DHCP), Zabbix+Grafana мониторинга — Виртуализации на Proxmox, работы с LVM/RAID Стек: Linux (Ubuntu, Debian, Fedora), Docker, Podman, Kubernetes, GitLab CI/CD, GitHub Actions, ArgoCD, Git, Bash, PowerShell. terraform (основы) Gradle, Maven Oracle Database, PostgreSQL, MySQL Zabbix, Grafana, Prometheus (basic), Wireshark VMware, Proxmox, Synology NAS Cisco, MikroTik, VPN (IPSec/L2TP), Active Directory, GPO Telegram: @tixo_blet
Публикатор: Roman Y. Обсуждение: @devops_jobs #резюме #LeadDevOps #SeniorDevOps #DevOps #InfrastructureArchitect Позиция: DevOps / DevOps Team Lead / Infrastructure Architect Формат работы: удаленно Занятость: полная Ожидания по оплате: от 1700 USD/эквивалент в месяц. Коллеги, приветствую. Это не вакансия, а резюме. Резюме, которые вы мне почему-либо направите, будут проигнорированы (да, я знаю, что всем надоело это предуведомление). Нахожусь в поиске позиции Senior DevOps / DevOps Team Lead / Infrastructure Architect (async-first). Готов рассмотреть и менее ответственные позиции (вплоть до Junior). Без ночных дежурств (UTC+6), дневные/вечерние как в будние, так и в выходные дни — по договоренности, эскалации также по договоренности. Готовность к смене сферы деятельности (с CDN/Streaming на что-то еще). За плечами руководство инфраструктурной командой (6 чел.), перешедшее затем в руководство всей технической командой (+ 2 PHP devs & 2 QA). Два основных продукта: зрелая стриминг-платформа (800+ входящих стримов, 500+ платящих/2300+ неплатящих одновременных пользователей в среднем, 80+ ТБ видео) и пилот облачного сервиса для транскодирования видео. Ответственности: Техническая: CDN, мониторинг, деплои, IaC, внутренние self-hosted-средства разработки, коммуникации и управления. Организационная: написание внутренних гайдлайнов, гашение конфликтов, право "последнего слова" на все решения технической команды. R&D. Стек инфраструктуры: Bare-metal-хостинги (Hetzner, Scaleway, OVH, colocation-стойка в Worldstream) GitLab & GitLab CI Ansible Docker MikroTik Zabbix Grafana (как удобный фронтенд к Zabbix для первой линии) Nginx Стек разработки: Laravel Vue Новое-модное: Разработка с использованием LLM С чем не сталкивался (из критичного сегодня): k8s Гиперскейлеры Self-hosted СХД (имеется в виду, прежде всего, Ceph) Мультиагентная разработка Готов как к исполнительской роли — сопровождению Linux/Docker, типовым изменениям в Ansible и CI/CD, мониторингу, бэкапам и первичной диагностике инцидентов, — так и к выстраиванию этих процессов "с нуля" и подбору cost-effective-решений на базе bare-metal-хостингов. В IT более 15 лет, в стриминге был более 5, решил посмотреть в сторону других сфер. Оплата криптой (только well-known-койны и/или стейбл-токены). Контакты: TG: @rom_yar LinkedIn: (по запросу в ЛС)ь
Публикатор: Mikhail Обсуждение: @devops_jobs #резюме #devops #sre #remote Senior DevOps / SRE / Infrastructure Engineer — удалённо, B2B 17+ лет единственным инженером инфраструктуры непрерывного производства (24/7): виртуализация, сети, мониторинг, backup/DR, дежурства. 25+ лет Linux. Стек: Kubernetes (bare-metal k3s, Helm, ArgoCD GitOps) · Terraform, Ansible · VMware vSphere, Proxmox · Jenkins, GitLab CI, GitHub Actions · Prometheus, Grafana, Loki, VictoriaMetrics · Kafka (Strimzi), PostgreSQL · WireGuard, VLESS+Reality, Traefik, Nginx · Velero, MinIO, Proxmox Backup Server · Go, Python (FastAPI, SQLAlchemy, Alembic), Bash Публичные репозитории с CI: Go-утилита мониторинга туннельных нод + Python-сервис хранения истории проб, bare-metal Kubernetes/GitOps-стенд с регулярными DR-учениями. Ссылки на код и CV — в личке. Ожидания по зарплате: от $3500 net (USD/USDT) Формат: full remote, B2B-контракт, полная занятость. Готов приступить сразу. Контакт: @baremetal_ops
Публикатор: Aleks M Обсуждение: @devops_jobs #резюме Формат работы: удаленка Занятость: полная Ожидания по зарплате: обсуждаемо Технический стек: Linux (Ubuntu, Debian),FreeBSD, Windows Server (2003 по 2022), Docker и Docker Compose, Kubernetes, Helm, Terraform, Ansible, CI/CD через GitHub Actions, Prometheus, Grafana, Zabbix, AWS (EC2, S3, IAM, CLI), Python (Flask), Bash, PowerShell, PostgreSQL, MS SQL Server, VMware ESXi, Hyper V, Proxmox, Active Directory и GPO, DNS, DHCP, сети TCP/IP, VLAN, VPN, оборудование Cisco и MikroTik, Git Обо мне: за 17 лет в IT я научился главному, находить баланс между стабильностью инфраструктуры и скоростью изменений, которые нужны бизнесу. Прошёл путь от системного администратора до руководителя службы технической поддержки, где отвечаю за бесперебойную работу сервисов для 200 плюс пользователей и 10 распределённых объектов, а также управляю технической командой. Что это дало бизнесу на практике. Когда 1С начала не справляться с нагрузкой и тормозить работу сотрудников, я провёл аудит и перепроектировал архитектуру на кластер из трёх серверов с корректным лицензированием, критичный сервис перестал быть узким местом. Выстроил регламенты технической поддержки и контроль сроков через Jira, что снизило количество и длительность простоев. Многолетний опыт с Zabbix помогает видеть проблемы до того, как они превращаются в инцидент, а не разбираться постфактум. Последний год я целенаправленно перевожу этот подход на язык DevOps, потому что вижу, как автоматизация и контейнеризация напрямую экономят время команды и снижают риск человеческой ошибки при релизах. Самостоятельно собрал полный pipeline, Python приложение на Flask, контейнеризация через Docker, CI/CD через GitHub Actions с автотестами, оркестрация в Kubernetes с масштабированием, инфраструктура как код через Terraform, мониторинг через Prometheus и Grafana, Helm chart для управления релизами. Делал это не ради строчки в резюме, а чтобы на практике понимать, как ускорить и обезопасить путь от кода до продакшна. Ищу позицию DevOps инженера уровня Middle, где смогу приносить пользу сразу, за счёт сильной инфраструктурной базы, умения предотвращать инциденты и держать в голове реальную стоимость простоя для бизнеса, и одновременно расти в направлении современных DevOps практик рядом с более опытными коллегами. Резюме (PDF): https://github.com/xwarhamx/-devops-project777/commit/50bac7b862188055a40701f4312cd0dbaba74e88 Репозиторий с DevOps pipeline и Helm chart: github.com/xwarhamx/-devops-project777 Контакты: @xwarhamx email: aleksandrmar87@gmail.com
Публикатор: Valeriya HR GGR Обсуждение: @devops_jobs #вакансия #DevOps #fulltime Senior / Lead DevOps GGR Global — международная группа компаний (iGaming). Разрабатываем собственные технологические продукты для глобальных рынков. Строим решения с нуля и растем без бюрократии. Удалённо | Full-time Вилка: от 5000-7500$ (готовы обсуждать ) Ключевые требования (must-have): • 7+ лет DevOps, из них 3+ года self-managed K8s в проде - Глубокий опыт bare-metal Kubernetes(kubeadm/kubespray, etcd, ротация сертификатов, PDB) • HA PostgreSQL + Patroni(репликация, PITR, RPO/RTO, валидация бэкапов) - Сильный GitOps на ArgoCD (app-of-apps, ApplicationSet, работа со stateful) - Ansible/Salt + GitLab CI - Vault + External Secrets - Prometheus / VictoriaMetrics / Grafana - Linux (глубоко) + автоматизация (Python/Bash/Go) - Аккуратность с продом и высокая автономность Задачи: • Развитие self-managed K8s-платформы, Patroni-кластеров, GitOps, мониторинга и снижение bus-factor. • Ротация секретов, ключей и сертификатов через HashiCorp Vault + External Secrets • Развитие систем мониторинга и алертинга (Prometheus, VictoriaMetrics, Grafana), расследование инцидентов • Устранение техдолга и актуализация runbook/документации для минимизации bus-factor Без бюрократии, удалёнка, индексация ЗП. По любым вопросам @Valeriya_HR_GGR
Публикатор: Alex Shabalin Обсуждение: @devops_jobs #резюме #devops #remote Позиция: DevOps-инженер Формат: удалённо Занятость: full-time ЗП: от 3600$ / 300000 рублей на руки Контакт: @Alex_Shabalin Обо мне: ВАЖНО: Ищу работадателя, которому не требуется мое пребывание на территории РФ. Если это не про вас - пожалуйста, пройдите мимо. Инженер с 10-ти летним опытом в it - от эникея до devops-инженера. Имею production-опыт (последние 3 года) с Kubernetes, CI/CD, мониторингом, автоматизацией и базами данных. Участвовал в проессах запуска и сопровождения инфраструктуры для различных проектов, выполнял задачи по оптимизации сборки и деплоя. Практический опыт: — Разворачивал и сопровождал kubernetes-кластеры (YC, k3s, talos - в своей homelab); — Имею опыт взаимодействия с инфраструктурой, расположенной в облаке (yandex cloud, selectel, vk cloud); — Администрировал Linux-инфраструктуру; — Писал + сопровождал CI/CD пайплайны в GitLab, имею опыт по взаимодействию с Jenkins и azure devops; — Дорабатывал Dockerfile (multi-stage) и Helm-чарты; — Писал Ansible-плейбуки для конфигурирования серверов и установки ПО; — Писал и дорабатывал IAC-манифесты (terraform, terragrunt, hashicorp packer); — Сопровождал и обновлял self-hosted sentry (sigh); — Внедрял + сопровождал деплой с использованием GitOps подхода (ArgoCD); — Работал с PostgreSQL: бэкапы (pg_dump, pg_basebackup), легкий траблшутинг; — Взаимодействовал с разработкой для решения вопросов связанных с CI/CD и инфраструктурой — помогал диагностировать и решать проблемы с последующим описанием решений в документации; — Внедрял большой спектр информационных систем, в зависимости от пожеланий заказчика на проекте, дорабатывал уже имеющиеся решения или предлагал свои;
Публикатор: Nelly Обсуждение: @devops_jobs #вакансия #remote #РФ #SQL #Python #Oracle #airflow Компания: Selecty Позиция: старший инженер (дежурная смена) Уровень дохода: 130-170 к гросс Формат: ТК/ИП Удаленка РФ Откликнуться: @Nelly_Selecty Ищем сотрудника в команде дежурной смены сопровождения. График работы сменами, 3 смены в неделю по 12 часов (с 19:00 до 07:00 ИЛИ с 21:00 до 09:00) чем предстоит заниматься: - Сопровождение и анализ текущих ETL-процессов загрузки данных. - Мониторинг процессов загрузки и выявления аномалий - Выполнение инструкций от ежедневной команды Обязательные требования: Критично: Знание SQL, Informatica Power Center и Airflow Языки программирования: SQL, Python на уровне знаний библиотек для ETL. Технологический стек: Greenplum, Oracle, Apache Airflow, Informatica PowerCenter, знание S3 и Apache Iceberg будет плюсом. - Навыки работы с: Jira + Confluence или графике - Навыки системного анализа, тестирования Условия: Оформление в IT-аккредитованную компанию ДМС (включая стоматологию) Компенсация фитнеса Скидки на обучение английскому (Skyeng) Индексация заработной платы Современная техника IT-аккредитация компании Место для откликов: @Nelly_Selecty
Публикатор: Владимир Обсуждение: @devops_jobs #резюме #devops #sre #monitoring #remote #kubernetes Позиция: DevOps-инженер Формат: удалённо / гибрид Занятость: full-time Контакты: @vestik712 Обо мне DevOps-инженер с опытом 3.5 года в поддержке и развитии контейнерной и серверной инфраструктуры. Работал с Kubernetes, CI/CD, мониторингом, автоматизацией и базами данных. Участвовал в сопровождении микросервисных проектов, занимался оптимизацией сборки и деплоя. Основной фокус — CI/CD: GitLab CI, ArgoCD (GitOps), Helm. — Kubernetes: развёртывание, администрирование (Deckhouse, Longhorn), миграция сервисов. — Observability: Prometheus, Grafana, Alertmanager, Loki, OpenSearch/Graylog. — IaC и автоматизация: Ansible, Terraform. — Секреты: HashiCorp Vault, External Secrets. — Базы данных: PostgreSQL (бэкапы, репликация, PITR), Kafka, Redis. — Инфраструктура: Linux (Ubuntu), Docker, Nginx, containerd. Практический опыт — Администрировал Linux-инфраструктуру на Ubuntu (on‑prem + облако). — Разворачивал и сопровождал Kubernetes-кластеры (Deckhouse) — установка, ротация сертификатов, настройка Longhorn, управление RBAC. — Проектировал CI/CD пайплайны в GitLab CI, внедрил GitOps через ArgoCD (синхронизация кластера с репозиторием). — Оптимизировал Dockerfile (multi-stage) и Helm-чарты — ускорил сборку и уменьшил размер образов. — Настраивал мониторинг и алертинг на Prometheus + Grafana, логи через Fluent Bit + OpenSearch. — Писал Ansible-плейбуки для автоматизации установки ПО и настройки серверов. — Работал с PostgreSQL: бэкапы (pg_dump, pg_basebackup, Wal-G), репликация, PITR, восстановление. — Автоматизировал релизы через Python-скрипты (версионирование по semver). — Участвовал в дежурствах, разборе инцидентов, пост-мортемах с RCA. — Вёл техническую документацию в Confluence / Jira. Стек Linux, Docker, Kubernetes, Helm, Git, GitLab CI, ArgoCD, Ansible, Terraform, Vault, Prometheus, Grafana, Loki, OpenSearch, Graylog, PostgreSQL, Kafka, Redis, Python, Bash, Nginx, Deckhouse, Longhorn, Wal-G. Быстро вникаю в проекты, готов к новым задачам и развитию в облачных технологиях.
Публикатор: Игорь Быков Обсуждение: @devops_jobs #резюме Позиция: DevOps-инженер Формат: удалённо, гибрид Локация: Санкт-Петербург, Россия Занятость: full-time, part-time Контакт: @an3k0t Опыт: - Развертывание, настройка и эксплуатация production-инфраструктуры на базе Kubernetes. - Администрирование Linux-систем, контейнерной инфраструктуры Docker/Kubernetes, сетевых компонентов и хранилищ.- Разработка и сопровождение CI/CD процессов для автоматизации сборки, тестирования и доставки приложений (GitLab CI/CD, GitVerse). - Автоматизация инфраструктуры с использованием Infrastructure as Code подходов (Helm, Helmfile, Ansible).- Разработка и сопровождение Helm chart для развертывания приложений в Kubernetes. - Настройка мониторинга, логирования и анализа состояния сервисов (Prometheus, Grafana, Loki, Alloy). - Настройка сбора метрик, алертинга и контроль состояния production-сервисов. - Реагирование на инциденты, поиск причин неисправностей (Root Cause Analysis) и устранение проблем. - Настройка резервного копирования данных сервисов на удаленные серверы с использованием Restic. - Взаимодействие с командами разработки для улучшения процессов доставки и эксплуатации. Достижения: - Реализовал CI/CD pipeline для автоматического развертывания изолированных тестовых стендов от любой feature-ветки проекта. Pipeline динамически создавал окружение, максимально приближенное к production, включая адаптацию конфигурации приложения для локальной замены интеграций с AWS и S3, обновлял конфигурацию Nginx с выделением домена для каждого стенда. Для отслеживания создал внутренний интерфейс на базе GitLab API для управления и просмотра развернутых окружений. - Развернул и настроил GitVerse Runner в Kubernetes с разработкой собственного Helm chart для автоматизации CI/CD процессов. - Внедрил CrowdSec для защиты инфраструктуры, разработал кастомные сценарии обнаружения угроз на основе анализа логов сервисов. - Развернул и настроил production Kafka cluster с SASL-аутентификацией и ACL-политиками доступа. - Настроил управление Kafka-топиками, producer/consumer взаимодействие и эксплуатацию кластера. - Разработал кастомные Ansible роли для автоматизации развертывания Kafka UI и синхронизации Nginx-конфигураций. - Настроил систему мониторинга и логирования сервисов на базе Prometheus, Grafana, Loki и Alloy. - Провел анализ и нейтрализацию распределенной scraping-атаки на production-систему, восстановил стабильность работы сервисов. технологический стек: Linux: Ubuntu, Debian, CentOS/RHEL Containerization: Docker, Kubernetes, kubectl IaC: Helm, Helmfile, Ansible, Terraform CI/CD: GitLab CI/CD, GitVerse, GitLab Runner, GitVerse Runner Cloud: AWS (EC2, S3, IAM), VK Cloud Monitoring: Prometheus, Grafana, Loki, Alloy Messaging: Apache Kafka Web: Nginx, Apache, angie Backup: Restic, pgbackweb, pgdump, mysqldump Security: CrowdSec Практики: Infrastructure as Code, Incident Response
Публикатор: Hiccup Bloodrain Обсуждение: @devops_jobs #резюме #devops #sre #remote #k8s #kubernetes Формат работы: удалёнка Занятость: полная Грейд: Middle/Middle+ Ожидания по зарплате: от 270 000 ₽ в месяц на руки На связи: ежедневно с 09:00 до 00:00 Технический стек: Linux • Python • SQL • Docker • Docker Swarm • Kubernetes • Helm • ArgoCD • FluxCD • GitLab CI/CD • Terraform • Ansible • Bash • Nginx • Hashicorp Vault • Prometheus • Grafana • Alertmanager • ELK • Loki • PostgreSQL • MySQL • Backup • Gitlab CI/CD • GitHub Actions • Yandex Cloud --- Обо мне: 5+ лет коммерческого опыта в IT. Работал как с небольшими сетапами и поднимал их с нуля от репозитория в гите до рабочего продукта, так и с высоконагруженными платформами вплоть до параллельного сопровождения 500+ k8s кластеров и десятков репозиториев. Работал в финтехе (банк с молоточками), в CDP инструменте и в BI интеграторе Основные предпочтения по технологиям - облачный/baremetal kubernetes, CI/CD и автоматизация всего, что можно и нужно автоматизировать во избежание огромного toil, но занимаюсь всем из своего стека и готов изучать новые технологии и дальше. В качестве бонуса, очень дружу с Python, поэтому любые утилиты/скрипты/CLI/боты идут в комплекте. Начинал свою карьеру в IT с аналитики, поэтому отдебажить SQL могу с нескольких сторон. Telegram: @Jack_Frost13
Публикатор: Vlad M. Обсуждение: @devops_jobs #резюме #devops #sre #mlops #kubernetes #cicd DevOps Engineer / MLOps / SRE Локация: Москва Формат работы: гибрид или офис Занятость: полная, частичная или проектная Коммерческий опыт: 1 год 7 месяцев Контакт: @devops_dm Занимаюсь CI/CD, Kubernetes-инфраструктурой, мониторингом и эксплуатацией сервисов. Есть опыт в Python-разработке, развертывании ML-сервисов и LLM/RAG-решений. Что делал: - Разработал переиспользуемые шаблоны сборки и деплоя для Dev, Stage и Prod в GitLab CI и Jenkins. Сократил время деплоя с 20 до 3 минут. - Настраивал деплой сервисов в Kubernetes: манифесты, Helm-чарты, Ingress и пилотное внедрение ArgoCD. - Развернул Prometheus, Grafana и ELK Stack. Переработал правила алертинга и стабилизировал uptime инфраструктуры на уровне 99,5%. - Добавил в CI/CD проверку кода через SonarQube и сканирование Docker-образов с помощью Trivy. - Настроил резервное копирование PostgreSQL и администрировал инфраструктуру проектов на VPS в Selectel и Hetzner. - Обеспечивал деплой внутренних ML-сервисов на FastAPI в Kubernetes и настраивал мониторинг потребления ресурсов. - Разработал и развернул LLM-бота для L1-поддержки в Discord. Настроил RAG-пайплайн на базе LangChain/LlamaIndex и Qdrant/PGvector, классификацию запросов и передачу нерешённых обращений инженерам. - Руководил командой из трёх разработчиков: распределял задачи, проводил код-ревью и контролировал сроки. Стек: - Containers & Orchestration: Docker, Docker Compose, Kubernetes, Helm, ArgoCD - CI/CD & Automation: GitLab CI/CD, Jenkins, GitHub Actions, Bash, Python - Monitoring & Logging: Prometheus, Grafana, ELK Stack - Databases & MLOps: PostgreSQL, Qdrant, PGvector, DVC, FastAPI, LangChain, LlamaIndex - DevSecOps: Trivy, SonarQube - Infrastructure: Linux, Nginx, Selectel, Hetzner, AWS, RunPod Английский на уровне B2 Связь: @devops_dm
Публикатор: Artem Zhiyanov Обсуждение: @devops_jobs #резюме DevOps / MLOps Engineer Формат: Удаленно Занятость: Проектная / Полная Оформление: ИП / Самозанятый / Договор подряда Ставка: от 1200 час Опыт: 6+ лет Работа в компании бизнес аналитики - 4+ лет 2 Стартапа развитие + поддержка . **Стек:** Kubernetes (Kubeadm, k3s, Rancher), Helm, ArgoCD, GitLab CI AWS, Yandex Cloud — есть опыт миграции между провайдерами без даунтайма Data Engineering: Airflow, Trino, Apache Iceberg, Kafka, ClickHouse, dbt Security & SSO: Keycloak (AD/LDAP), HashiCorp Vault, Cert-manager Observability: Prometheus, Grafana, Alertmanager, Loki, Zabbix БД и стриминг: PostgreSQL, MariaDB, Redis, Kafka MLOps: MLflow, Kubeflow, vLLM **Что делал:** — Развернул с нуля 4 изолированных enterprise-контура и вывел в продуктивную эксплуатацию, включая доставку кода в закрытый контур без интернета — Сократил время релиза с 3 часов до 15 минут через GitOps на ArgoCD — Снизил MTTR на 40% после перехода на IaC и настройки наблюдаемости — Мигрировал production из Yandex Cloud в AWS и из Docker Compose в Kubernetes — без прерывания SLA — Восстановил инфраструктуру после кибератаки за счёт заранее настроенного IaC — Сопровождаю команды 10–20+ разработчиков: онбординг, ревью инфраструктурного кода, консультации по CI/CD и Kubernetes Резюме и подробности — в личку: @sun_solomone
Публикатор: Evgeniy Samsonov Обсуждение: @devops_jobs #резюме #devops #kubernetes #remote #fulltime Формат работы: удалённо Занятость: полная Локация: РФ Ожидания: 230 000р net Инфраструктурный инженер с 9-летним опытом проектирования и эксплуатации production-окружений (кинотеатры по всей России и СНГ). Управляю разнородной инфраструктурой от bare-metal серверов до multi-zone Kubernetes-кластеров. Специализируюсь на высокой доступности, масштабируемости и автоматизации. Достиг SLA 99.9% для критичных сервисов. Целенаправленно развивался в компании с технической поддержки -> системного администратора/инженера -> в DevOps специалиста. Опыт: Проектирование и эксплуатация инфраструктуры — Спроектировал и поддерживаю production-окружение для крупной сети кинотеатров (РФ и СНГ): управляю 1000+ серверами и подами Kubernetes. Полный цикл подготовки bare-metal серверов: настройка RAID, установка Linux/Windows server, конфигурирование BIOS/UEFI под высоконагруженное ПО. Тюнинг ядра Linux под пиковые нагрузки, профилирование и устранение узких мест. Технический стек: Контейнеризация & Оркестрация: Docker, Kubernetes (k8s), k3s IaC & Конфигурирование: Ansible, Helm, GitLab CI, ArgoCD Мониторинг & Observability: Prometheus, Grafana, VictoriaMetrics, Loki, Alertmanager Безопасность: HashiCorp Vault, WireGuard, cert-manager, TLS/SSL, RBAC Облачные системы: Terraform, aws, YC Networking: Nginx, HAProxy, iptables, TCP/IP, DNS, Hysteria2 Базы данных: PostgreSQL Языки: Bash, Go ОС: Linux Telegram: @gosu_ai
Публикатор: Игорь Быков Обсуждение: @devops_jobs #резюме Позиция: DevOps-инженер Формат: удалённо, гибрид Локация: Санкт-Петербург, Россия Занятость: full-time, part-time Контакт: @an3k0t Опыт: - Развертывание, настройка и эксплуатация production-инфраструктуры на базе Kubernetes. - Администрирование Linux-систем, контейнерной инфраструктуры Docker/Kubernetes, сетевых компонентов и хранилищ.- Разработка и сопровождение CI/CD процессов для автоматизации сборки, тестирования и доставки приложений (GitLab CI/CD, GitVerse). - Автоматизация инфраструктуры с использованием Infrastructure as Code подходов (Helm, Helmfile, Ansible).- Разработка и сопровождение Helm chart для развертывания приложений в Kubernetes. - Настройка мониторинга, логирования и анализа состояния сервисов (Prometheus, Grafana, Loki, Alloy). - Настройка сбора метрик, алертинга и контроль состояния production-сервисов. - Реагирование на инциденты, поиск причин неисправностей (Root Cause Analysis) и устранение проблем. - Настройка резервного копирования данных сервисов на удаленные серверы с использованием Restic. - Взаимодействие с командами разработки для улучшения процессов доставки и эксплуатации. Достижения: - Реализовал CI/CD pipeline для автоматического развертывания изолированных тестовых стендов от любой feature-ветки проекта. Pipeline динамически создавал окружение, максимально приближенное к production, включая адаптацию конфигурации приложения для локальной замены интеграций с AWS и S3, обновлял конфигурацию Nginx с выделением домена для каждого стенда. Для отслеживания создал внутренний интерфейс на базе GitLab API для управления и просмотра развернутых окружений. - Развернул и настроил GitVerse Runner в Kubernetes с разработкой собственного Helm chart для автоматизации CI/CD процессов. - Внедрил CrowdSec для защиты инфраструктуры, разработал кастомные сценарии обнаружения угроз на основе анализа логов сервисов. - Развернул и настроил production Kafka cluster с SASL-аутентификацией и ACL-политиками доступа. - Настроил управление Kafka-топиками, producer/consumer взаимодействие и эксплуатацию кластера. - Разработал кастомные Ansible роли для автоматизации развертывания Kafka UI и синхронизации Nginx-конфигураций. - Настроил систему мониторинга и логирования сервисов на базе Prometheus, Grafana, Loki и Alloy. - Провел анализ и нейтрализацию распределенной scraping-атаки на production-систему, восстановил стабильность работы сервисов. технологический стек: Linux: Ubuntu, Debian, CentOS/RHEL Containerization: Docker, Kubernetes, kubectl IaC: Helm, Helmfile, Ansible, Terraform CI/CD: GitLab CI/CD, GitVerse, GitLab Runner, GitVerse Runner Cloud: AWS (EC2, S3, IAM), VK Cloud Monitoring: Prometheus, Grafana, Loki, Alloy Messaging: Apache Kafka (SASL, ACL) Web: Nginx, Apache Backup: Restic Security: CrowdSec Практики: Infrastructure as Code, Incident Response
Публикатор: Vadim Обсуждение: @devops_jobs #резюме #devops #sre #platformengineer #kubernetes #remote #fulltime #gitops #iac DevOps / SRE / Platform Engineer Опыт работы: 4 года 7 месяцев Локация: Москва, Россия Формат: Удаленно Занятость: Full-time Контакт: @DevOps_savage Ключевой стек: - Orchestration & Mesh: Kubernetes, Helm, Argo CD, Istio, Docker - IaC & Automation: Terraform, Ansible, Python, Bash - CI/CD & DevSecOps: GitLab CI/CD, Jenkins, HashiCorp Vault, Trivy, SonarQube - Observability & Logging: Prometheus, Grafana, Jaeger, Alertmanager, ELK/EFK Stack - DB, Caching & Brokers: PostgreSQL (Patroni, pgBackRest), Redis, Apache Kafka, RabbitMQ - Cloud & Infrastructure: AWS, Yandex Cloud, Nginx, HAProxy, Linux (Ubuntu, CentOS) Главные кейсы и достижения: Миграция, K8s и IaC (Платформа): - Спроектировал и реализовал zero-downtime миграцию 50+ микросервисов из изолированных ВМ в Managed Kubernetes через Terraform (3 кластера, 300+ нод). - Разработал библиотеку переиспользуемых Terraform-модулей (VPC, IAM, EKS, DB), сократив время развертывания новых окружений с 2 дней до 30 минут. - Провел FinOps-оптимизацию ресурсов (right-sizing, spot-инстансы, HPA/VPA): снизил утилизацию CPU в простое на 40% при росте общего трафика системы на 50%. CI/CD, GitOps и DevSecOps: - Внедрил платформу автоматизированного деплоя на базе K8s, Helm и Argo CD, сократив Time-to-Market с 4 дней до 3 часов, а время релиза в GitLab CI — с 35 до 8 минут (failed deployments снизились на 45%). - Развернул HashiCorp Vault для 150+ сервисов, полностью ликвидировав хардкод-секретов в Git и автоматизировав их ротацию. - Встроил Trivy и SonarQube в CI/CD пайплайны и перевел 30+ сервисов на multi-stage builds, уменьшив размер Docker-образов на 55%. Observability, Service Mesh и Надежность (SRE): - Настроил Istio Service Mesh для 40+ микросервисов (канареечные релизы с автоматическим откатом при error rate > 1%). - Построил единый контур мониторинга по принципам SLO/SLA (Prometheus, Grafana, Jaeger): снизил MTTR с 35 до 10 минут, сократил ложные алерты на 60% и поднял SLA до 99.98%. - Внедрил централизованный сбор логов (>10 млн записей в сутки), сократив время локализации сложных аномалий с 25 до 5 минут. Базы данных и Высокая нагрузка: - Настроил катастрофоустойчивый кластер PostgreSQL (Patroni, pgBackRest) с авто-бэкапами в S3 (RTO < 5 минут, RPO < 30 секунд). - Оптимизировал Redis-кластер под нагрузкой >20K RPS, снизив p99 latency ответов БД на 30%. - Автоматизировал управление Kafka-кластером (8 брокеров) и массовую конфигурацию 150+ Linux-серверов через Ansible playbooks (время обновления сократилось с 2 дней до 3 часов).