НПП Баум
1 job
2 days ago
SRE-инженер
HybridCISFull-time
Russia
Design fault-tolerant architecture and observability (metrics, logs, tracing) for corporate IT infrastructure; investigate incidents, run post-mortems, set up meaningful alerting and reliability processes. Core stack: Prometheus, Grafana, Loki, Tempo, Docker, Kubernetes on Linux.
ansible bash docker grafana kubernetes +4 skills