T

Site Reliability Engineer 2

Tata Consultancy Services · Chennai, Tamil Nadu, India

4–10 yrs experiencefull_timePosted 1w ago

Job description

**TCS Hiring!!!** **Role & responsibilities** Strong hands-on with Kubernetes (deployment, scaling, RBAC, networking, Helm/Kustomize) Ansible for configuration management, automation, and infra as code Python for tooling, automation, and platform integrations Expertise in Linux, networking (DNS, TCP/IP, HTTP), and shell scripting Observability: logging/metrics/tracing (e.g., Prometheus, Grafana, ELK/OpenSearch, OpenTelemetry) CI/CD pipelines (GitLab/GitHub Actions/Azure DevOps/Jenkins) and GitOps workflows (e.g., Argo CD) Experience running production systems with oncall support and incident response Cloud platforms: AWS (EKS/AKS/GKE), Terraform/Pulumi Service meshes (Istio/Linkerd), Ingress/Nginx/Envoy, API gateways Security basics: secrets management, image scanning, Kubernetes security (OPA/Gatekeeper/Kyverno) Message brokers/streaming: Kafka/RabbitMQ; caches: Redis Cost optimization, capacity planning, performance tuning Familiarity with SRE practices: SLOs/SLIs, error budgets, runbooks, postmortems