Source description
About the role
Role Overview: You are a Senior Software Engineer / Site Reliability Engineer (SRE) with a focus on Observability & Platform Engineering. Your primary responsibility will be to support platform reliability, monitoring, and modernization initiatives. This role will involve a blend of software engineering (6070%) and site reliability engineering (3040%), with a strong emphasis on Kubernetes and observability platforms. Key Responsibilities: - Support platform reliability, monitoring, and modernization initiatives - Provide operational and training support for DataDog, the Observability Platform for R&D - Enhance observability, reliability, and performance across engineering platforms - Drive automation and operational excellence for monitoring and alerting frameworks - Support Kubernetes-based platform operations and monitoring integrations Qualification Required: - Strong proficiency in at least one of the following: Python, JavaScript (Node.js), or Java - Hands-on experience with API integrations (designing, consuming, and integrating APIs) - Strong experience working in Kubernetes environments, including deployment, operations, and monitoring - Experience with DataDog (preferred) or similar tools such as Prometheus, Grafana - Ability to configure dashboards, alerts, and APM (tracing, metrics, logging) - Experience monitoring containerized and microservices architectures - Hands-on experience with AWS - Experience integrating observability tools into cloud environments - Experience with CI/CD integrations for observability (e.g., DataDog in pipelines) - Ability to automate monitoring and operational tasks using scripting (Python preferred) Additional Details of the Company: Project Overview: The company is seeking a Senior Software Engineer / SRE with an Observability focus to support platform reliability, monitoring, and modernization initiatives. The role requires a proactive approach to lead maintenance efforts and platform improvements, along with experience in installing and configuring DataDog agents and integrations, managing API keys, and secure configurations, and managing user roles and access controls within observability platforms. Role Overview: You are a Senior Software Engineer / Site Reliability Engineer (SRE) with a focus on Observability & Platform Engineering. Your primary responsibility will be to support platform reliability, monitoring, and modernization initiatives. This role will involve a blend of software engineering (6070%) and site reliability engineering (3040%), with a strong emphasis on Kubernetes and observability platforms. Key Responsibilities: - Support platform reliability, monitoring, and modernization initiatives - Provide operational and training support for DataDog, the Observability Platform for R&D - Enhance observability, reliability, and performance across engineering platforms - Drive automation and operational excellence for monitoring and alerting frameworks - Support Kubernetes-based platform operations and monitoring integrations Qualification Required: - Strong proficiency in at least one of the following: Python, JavaScript (Node.js), or Java - Hands-on experience with API integrations (designing, consuming, and integrating APIs) - Strong experience working in Kubernetes environments, including deployment, operations, and monitoring - Experience with DataDog (preferred) or similar tools such as Prometheus, Grafana - Ability to configure dashboards, alerts, and APM (tracing, metrics, logging) - Experience monitoring containerized and microservices architectures - Hands-on experience with AWS - Experience integrating observability tools into cloud environments - Experience with CI/CD integrations for observability (e.g., DataDog in pipelines) - Ability to automate monitoring and operational tasks using scripting (Python preferred) Additional Details of the Company: Project Overview: The company is seeking a Senior Software Engineer / SRE with an Observability focus to support platform reliability, monitoring, and modernization initiatives. The role requires a proactive approach to lead maintenance efforts and platform improvements, along with experience in installing and configuring DataDog agents and integrations, managing API keys, and secure configurations, and managing user roles and access controls within observability platforms.
More at Jade Global Software Pvt LTD
Related open roles
Workday Prism Analytics Consultant
Mumbai
Senior Boomi Developer - B2B and EDI Integration Specialist
Mumbai
Senior Business Intelligence and Data Analytics Technical Lead
Mumbai
AI/ML and Agentic AI Developer
Hyderabad
RPA Developer - UiPath Specialist
Hyderabad
Artificial Intelligence and Machine Learning Engineer (Python and Large
Hyderabad