Role Summary
Optum is seeking a Site Reliability Engineer with strong experience in the ELK Stack, observability, monitoring, cloud platforms, Kubernetes, CI/CD, and SRE practices.
The engineer will be responsible for developing and supporting enterprise observability solutions, troubleshooting application and platform issues, and collaborating effectively with stakeholders.
Required Qualifications
- 5+ years of experience with the ELK Stack (Elasticsearch, Logstash, Kibana).
- Strong expertise in Kibana dashboard development using Lens and advanced visualizations.
- Experience designing observability and monitoring dashboards for enterprise applications.
- Proficient in Elasticsearch DSL, KQL, and data modeling.
- Experience building and supporting Logstash ingestion pipelines.
- Knowledge of APM, distributed tracing, logging, metrics, and SRE practices.
- Experience with Azure/AWS, Kubernetes, CI/CD, and automation scripting.
- Strong analytical, troubleshooting, and stakeholder communication skills.
Key Technologies
- Elasticsearch
- Logstash
- Kibana
- Kibana Lens
- Elasticsearch DSL
- KQL
- APM
- Distributed Tracing
- Logging
- Metrics
- SRE
- Azure
- AWS
- Kubernetes
- CI/CD
- Automation Scripting