Infrastructure Team Lead (NOC-SRE)

  • Каган А., ФОП , Агенція
    • Дистанційна робота
    • Повна зайнятість·Стандартний графік: 5/2

    Про вакансію

    Про проект

    Інфраструктурна / production команда.

    Шукаємо Team Lead, який зможе керувати NOC / SRE / Infrastructure командою, покращувати внутрішні процеси, відповідати за incident management і водночас залишатися hands on у роботі з Linux, мережами та базами даних.

    Основні завдання

    • Управління NOC / Infrastructure / SRE-командою.
    • Організація змін, чергувань, on-call та ескалацій.
    • Incident management: робота з алертами, маршрутизація інцидентів, SLA/SLO, postmortem.
    • RCA / problem management.
    • Налаштування та покращення процесів у Jira / Confluence / KB / task tracker.
    • Покращення моніторингу та observability.
    • Координація роботи з командами Development, QA, DevOps, Product.
    • Hands-on участь у складних production-інцидентах.
    • L3 troubleshooting Linux / мереж / БД.
    • Створення та підтримка документації, runbooks, регламентів.
    • Менторинг інженерів та контроль якості роботи команди.

    Must have

    • Досвід роботи на позиції Team Lead / NOC Lead / Infrastructure Lead / SRE Lead.
    • Досвід управління командою інженерів.
    • Досвід роботи з production / critical services.
    • Розуміння incident management та escalation processes.
    • Практичний досвід RCA / postmortem / problem management.
    • Сильний бекграунд у Linux administration.
    • Хороші знання мереж: TCP/IP, routing, DNS, DHCP, NAT, VPN.
    • Досвід роботи з monitoring/alerting: Zabbix, Grafana, Prometheus, Alertmanager, New Relic, Splunk або аналогами.
    • Досвід роботи з task tracker та KB: Jira, Confluence або аналогами.
    • Вміння вибудовувати ефективні процеси без зайвої бюрократії.
    • Готовність залишатися hands on, а не переходити виключно в management.
    • Англійська для роботи з технічною документацією та комунікації.

    Nice to have

    • SRE background.
    • Kubernetes / Docker.
    • Terraform / Helm / GitLab CI.
    • Досвід роботи з Cloud: GCP / AWS / Azure.
    • PostgreSQL / MySQL.
    • MikroTik / L2/L3 switches / VLAN.
    • Досвід роботи у форматі 24/7 operations.
    • Досвід у fintech / crypto / highload / e-commerce.

    Кого ми шукаємо

    • Людину, яка вже керувала NOC / SRE / Infrastructure командою.
    • Вміє організувати зміни, зони відповідальності та процес ескалації.
    • Розуміє production risk і ціну помилки.
    • Може навести порядок у незрілих процесах та команді.
    • Не йде повністю в management і готова особисто підключатися до складних інцидентів.
    • Спокійно працює в умовах хаосу, але системно фіксує процеси та домовленості.
    • Вміє розвивати команду без мікроменеджменту та конфліктів.

    Ключові вимоги і навички

    • Досвід роботи від 5 років.
    • Користувач ОС Linux
    • MySQL
    • Jira
    • DHCP
    • PostgreSQL
    • Відповідальність
    • IP (Internet Protocol)
    • Docker
    • TCP/IP
    • Confluence
    • MikroTik
    • Zabbix
    • Ведення документації
    • AWS
    • Kubernetes
    • Управління командою
    • Налаштування DNS
    • Splunk
    • Координація команди
    Показати всі навичкиЗгорнути навички

    Схожі вакансії

    Усі схожі вакансії

    Статистика зарплат