Системный администратор / DevOps-инженер
О вакансии
Ищем системного администратора / DevOps-инженера в команду профессионалов, оказывающую
PSO-сервисы: эксплуатацию и развитие инфраструктуры клиентов, обеспечение доступности
сервисов и автоматизацию сопровождения.
Нам нужен инженер, который умеет разбираться в незнакомой инфраструктуре, находить причины
проблем, оценивать последствия изменений и доводить задачи до проверенного результата.
Ключевые навыки
GNU/LinuxTCP/IPOpenStackProxmoxTerraformDockerKubernetesNginxHAProxyPostgreSQLMySQLMariaDBZabbixPrometheusGrafanaAnsibleGitCI/CDGitOpsBashPython
Что важно знать
- Опыт администрирования производственной инфраструктуры от 3 лет: сопровождение
работающих систем, устранение инцидентов и проведение изменений;
- Уверенное администрирование Linux: установка и настройка ОС, права доступа, файловые
системы, анализ журналов и диагностика производительности;
- Понимание сетей: TCP/IP, DNS, маршрутизация, NAT, VPN, IPSec, межсетевые экраны,
HTTP/HTTPS и TLS. Умение диагностировать сетевую связность и проблемы доступа к
сервисам;
- Опыт работы с виртуализацией или облачной инфраструктурой: создание и сопровождение
виртуальных машин, настройка сетей и дисков, управление ресурсами. Практический опыт
эксплуатации OpenStack, Proxmox. Опыт использования Terraform, подходов Infrastructure
as Code и GitOps;
- Практический опыт работы с Docker и уверенные навыки эксплуатации Kubernetes;
- Опыт настройки и сопровождения веб-серверов, reverse proxy и балансировщиков, например
Nginx или HAProxy;
- Опыт сопровождения СУБД — PostgreSQL, MySQL/MariaDB: доступы, резервное копирование,
восстановление и первичная диагностика проблем;
- Опыт работы с мониторингом и оповещениями, например Zabbix, Prometheus и Grafana. Умение
определять причину срабатывания и настраивать полезные оповещения;
- Умение организовать резервное копирование и проверить восстановление. Понимание RPO и
RTO, принципов отказоустойчивости;
- Владение Bash или Python для автоматизации повседневных задач; опыт работы с Git и
инструментами управления конфигурациями, например Ansible;
- Понимание CI/CD и опыт сопровождения пайплайнов;
- Понимание принципов инфраструктурной безопасности: минимально необходимые права,
управление доступами, обновления, работа с секретами и разделение клиентских окружений;
- Английский язык на уровне чтения технической документации и разбора сообщений об
ошибках.
В сопровождении клиентов для нас важны
- Умение оценивать влияние инцидента на бизнес, определять приоритет и действовать с
учётом SLA;
- Способность локализовать проблему на уровне сети, ОС, виртуализации, контейнеров, БД или
приложения и своевременно подключать профильных специалистов;
- Аккуратное проведение изменений: оценка рисков, согласование, план отката и проверка
результата;
- Понятная коммуникация с клиентом: объяснить ситуацию, обозначить следующие действия и
своевременно сообщить статус;
- Ведение документации: схемы инфраструктуры, инструкции, порядок восстановления и история
значимых изменений;
- Участие в разборе инцидентов, поиск первопричин и предложение мер, снижающих вероятность
повторения;
- Ответственность за задачи, соблюдение конфиденциальности, готовность делиться знаниями и
развивать техническую экспертизу.
Будет преимуществом
- Опыт работы в сервисной компании и одновременного сопровождения нескольких клиентских
проектов;
- Международные сертификаты по Kubernetes: CKA, CKAD, CKS, KCNA, KCSA, Kubestronaut;
- Международные сертификаты по Linux: RHCSA, RHCE, RHCA;
- Международные сертификаты Fortinet или Juniper;
- Опыт построения отказоустойчивых решений и проведения проверок аварийного
восстановления;
- Примеры реализованной автоматизации, которая сократила ручную работу, количество ошибок
или время восстановления сервисов.