Инженер эксплуатации систем мониторинга и алертинга
Описание вакансии
Задачи:
- Развитие и администрирование стека сбора метрик и систем мониторинга.
- Повышение отказоустойчивости и масштабируемости решений.
- Развертывание и поддержка решений в Kubernetes, написание и доработка Helm-чартов.
- Миграция и обновление систем.
- Разбор инцидентов и их причин.
- Взаимодействие с командами разработки по вопросам наблюдаемости сервисов.
Требования:
- Опыт администрирования Linux от двух лет.
- Практический опыт работы с Kubernetes и Helm.
- Опыт построения CI/CD-пайплайнов.
- Опыт администрирования систем телеметрии и мониторинга.
- Знание Ansible, Git и принципов отказоустойчивости распределенных систем.
- Навыки диагностики приложений и инфраструктуры по логам и метрикам.
Будет плюсом:
- Знание Docker, сетевых протоколов и маршрутизации.
- Опыт эксплуатации ClickHouse, Redis, PostgreSQL и Kafka.
- Навыки написания скриптов на Bash или Python.
Условия: работа в офисе, удаленно или гибридно, гибкий график, предоставление техники. Доход зависит от технических знаний и навыков, предусмотрены пересмотр зарплаты и финансовые бонусы. Доступны обучение, технические конференции и развитие внутри компании.
Информация на странице подготовлена на основе открытых данных работодателя. Условия, требования и статус вакансии могут измениться. Перед откликом рекомендуем открыть оригинальную вакансию и сверить актуальные сведения.


