Job Description - Site Reliability Engineer (SRE) Support
Role: Site Reliability Engineer (SRE) - Production Support
Experience: 6 to 13 Years
Location: Bangalore
Work Model: 5 Days Work from Office (Mandatory)
Shift: 12:00 PM to 10:00 PM
Role Overview
We are seeking an experienced Site Reliability Engineer (SRE) to support and maintain mission-critical applications and cloud infrastructure. The ideal candidate should possess strong expertise in Azure Cloud, Java application support, Linux administration, Incident Management, Observability, Dynatrace, Splunk, and Root Cause Analysis (RCA). This is a hands-on production support role focused on ensuring platform reliability, availability, and operational excellence.
Key Responsibilities
- Provide L2/L3 production support for enterprise applications and services.
- Monitor application and infrastructure health using Dynatrace, Splunk, and observability platforms.
- Manage and resolve production incidents within defined SLA timelines.
- Lead incident triaging, troubleshooting, and coordination with cross-functional teams during major incidents.
- Perform detailed Root Cause Analysis (RCA) and implement preventive actions to avoid recurring issues.
- Support Java-based applications running on Azure cloud environments.
- Analyze application logs, system logs, and performance metrics to identify issues proactively.
- Work closely with development, infrastructure, and business teams to ensure service stability.
- Drive continuous improvements in monitoring, alerting, automation, and operational processes.
- Participate in deployment validations, release support, and change activities.
- Create and maintain support documentation, runbooks, and operational procedures.
Mandatory Skills
Site Reliability Engineering (SRE)
- Incident Management
- Problem Management
- Root Cause Analysis (RCA)
- Service Reliability and Availability Management
Cloud
- Microsoft Azure
- Azure Infrastructure and Services
- Cloud Operations & Support
Application Support
- Java Application Support
- Performance Analysis and Troubleshooting
- Production Support
Linux
- Linux Administration
- System Monitoring and Troubleshooting
Monitoring & Observability
- Dynatrace
- Splunk
- Observability Tools
- Application Performance Monitoring (APM)
- Log Monitoring and Analysis
- Alert Management
Preferred Skills
- Shell Scripting / Python Scripting
- ITIL Processes
- DevOps and CI/CD Concepts
- Kubernetes and Container Technologies
- Automation and Operational Excellence Practices
Desired Candidate Profile
- Strong experience in Production Support / SRE environment.
- Hands-on expertise in managing critical production incidents.
- Excellent troubleshooting and analytical skills.
- Ability to work effectively in a shift-based support model.
- Strong communication and stakeholder management skills.
- Experience supporting high-availability enterprise applications.
Qualification
- Bachelor's Degree or Master's Degree in Computer Science, Information Technology, Engineering, or related discipline.
Summary
Experience: 6-13 Years
Location: Bangalore
Shift Timing: 12 PM - 10 PM
Work Model: 5 Days Work from Office
Role Type: Production Support / Site Reliability Engineering (SRE)
Primary Skills: Azure, Java Support, Linux, Dynatrace, Splunk, Incident Management, Observability, RCA, Production Support.
#LI-AS7
À propos de Cognizant
Cognizant (NASDAQ: CTSH) est un AI Builder et une entreprise de services numériques (ESN) élaborant des solutions complètes d’IA maximisant les investissements pour des résultats concrets. Sa profonde expertise des métiers, des processus et des technologies lui permet d’intégrer dans les systèmes technologiques le contexte unique de chaque organisation de l’ingénierie à la production à l’échelle. Son objectif: améliorer l’efficacité des équipes, créer de la valeur et permettre aux grandes entreprises de rester performantes dans un monde qui évolue rapidement. Pour en savoir plus: cognizant.ai ou @cognizant.
À savoir avant de postuler
- Autorisation de travail: Cognizant ne prendra en considération que les candidats à ce poste qui sont légalement autorisés à travailler au Canada sans avoir besoin d'un parrainage de l'employeur, aujourd'hui ou à l'avenir.
- Mesures d’adaptation: Si vous avez un handicap qui nécessite des mesures d’adaptation raisonnable pour effectuer une recherche d’emploi ou poser une candidature, veuillez envoyer un courriel à [email protected] avec votre demande et vos coordonnées.
- L’IA dans notre processus de recrutement: Nous utilisons des outils d'intelligence artificielle (IA) pour trier et évaluer les candidatures efficacement. Notre équipe examine ensuite les candidatures et décide qui passe à l’étape suivante.
- Poste à pourvoir: Sauf indication contraire, ce poste est actuellement vacant et nous cherchons à le pourvoir.
- Exigences linguistiques: Nous demandons à tous les candidats de posséder une connaissance de base de l’anglais afin de faciliter les communications internes. Pour les postes au Québec, la capacité à communiquer efficacement en anglais est requise car vous fournirez des services à et collaborerez avec des parties prenantes anglophones situées hors de la province.
- Inclusion: Cognizant est un employeur souscrivant au principe de l’égalité d’accès à l’emploi. Votre candidature et votre dossier ne seront pas examinés en fonction de la race, de la couleur, du sexe, de la religion, des croyances, de l'orientation sexuelle, de l'identité de genre, de l'origine nationale, du handicap, des renseignements génétiques, de la grossesse, du statut d'ancien combattant ou de toute autre caractéristique protégée par les lois fédérales, provinciales ou locales.











