O
Out of the Box Systems
DevopsSenior
Senior Site Reliability Engineer, DevOps
BashPythonMakefileKubernetesDockerGkeTerraformAnsibleGitHub ActionsCircleCITravis CIAWSGCPAzureHetznerPostgreSQLRedis CacheOpensslPrometheusGrafanaElasticsearchLogstashKibanaLinux
Про позицію
We are looking for a Senior DevOps/SRE Engineer for a remote position. The role involves technical leadership, working with Kubernetes, Docker, CI/CD, and monitoring tools. The company offers long-term collaboration with compensation based on experience.
Обовʼязки
- Брати на себе технічне лідерство
- Ділитися знаннями та допомагати розвиватися іншим членам команди
- Developing and implementing infrastructure, configuration, and code branching strategies.
- Conducting integration, regression, UI/UX, API, load/stress, and other types of testing.
- Identifying, documenting, and tracking software defects and bugs.
- Monitoring and analyzing quality metrics to identify areas for improvement.
- Experience with automated testing frameworks such as Selenium, Appium, JMeter, etc.
- Mentoring Junior/Middle engineers, conducting code review, technical discussions, knowledge sharing
Вимоги
- Досвід роботи DevOps Engineer та практичний досвід Site Reliability Engineering (SRE)
- Досвід побудови та підтримки високодоступних production-систем із високими вимогами до reliability.
- Досвід роботи з Kubernetes у production-середовищі
- Розуміння принципів високої доступності, масштабування та відмовостійкості систем
- Досвід побудови та підтримки CI/CD процесів
- Англійська мова — Intermediate+
- Уміння слідувати code conventions
- Здатність навчатися
- Здатність наполегливо працювати
- Критичне мислення
- Витривалість
- Спроможність лаконічно та чітко пояснювати свою думку
- Бажання ділитися знаннями, проводити менторинг та допомагати розвиватися іншим членам команди
- Відданість нашим проєктам
- Прозорість
- Bash, Python, Makefile
- Kubernetes, Docker, GKE
- Terraform, Ansible
- GitHub Actions, CircleCI, TravisCI
- AWS, GCP, Azure, Hetzner
- SQL, NoSQL (PostgreSQL, Redis)
- OpenSSL
- Prometheus, Grafana, ELK Stack (Elasticsearch, Logstash, Kibana)
- Linux
- SLI / SLO / SLA, Incident Response, Root Cause Analysis (RCA), High Availability, Capacity Planning, Disaster Recovery, Performance Optimization, Reliability Engineering
Senior Site Reliability Engineer, DevOps
Оригінал