Senior Site Reliability Engineer

💰 ₹50,400 - ₹80,640 (Est.) 📍 Montréal

Job Description

As a Senior Site Reliability Engineer, you will lead the design, implementation, and maintenance of highly reliable, scalable, and efficient infrastructure and services. You will collaborate closely with development teams to ensure system reliability, performance, and availability while driving automation and operational excellence across the platform.

Primary Responsibilities:
Lead the design, deployment, and operation of large-scale, fault-tolerant systems to ensure high availability and performance.
Develop and implement automation to streamline deployment, monitoring, and incident response processes.
Monitor system health, analyze metrics, and proactively identify and resolve reliability, scalability, and performance issues.
Collaborate with software engineering teams to improve system design, deployment pipelines, and operational practices.
Manage incident response, conduct root cause analysis, and implement corrective actions to prevent recurrence.
Drive continuous improvement in infrastructure efficiency, reliability, and scalability through innovative solutions.
Document system architecture, operational procedures, and best practices to support knowledge sharing and operational consistency.
Mentor and provide technical leadership to junior SREs and cross-functional teams.
Participate in on-call rotations to ensure 24/7 system reliability and rapid incident resolution.
Engage with stakeholders to align SRE practices with business goals and technical strategies.

Key Skills and Qualifications:
Extensive experience in site reliability engineering, systems engineering, or related roles, typically 5+ years.
Strong proficiency with cloud platforms (AWS, Azure, Google Cloud) and container orchestration tools (Kubernetes, Docker).
Expertise in Linux system administration, networking, and security best practices.
Proficient in programming and scripting languages such as Python, Go, Bash, or similar for automation.
Experience with infrastructure as code (Terraform, Ansible, CloudFormation) and CI/CD pipelines.
Deep understanding of monitoring, logging, and alerting tools (Prometheus, Grafana, ELK stack).
Proven ability to design and maintain scalable, distributed systems and fault-tolerant architectures.
Strong problem-solving skills and ability to handle complex technical challenges independently.
Excellent communication skills to collaborate effectively across teams and with external vendors.
Familiarity with incident management frameworks and service-level objectives (SLOs), service-level agreements (SLAs).

Preferred Qualifications:
Bachelor’s degree in Computer Science, Engineering, or a related technical field.
Certifications in cloud technologies (AWS Certified Solutions Architect, Google Professional Cloud Architect, etc.).
Experience with financial services, large-scale SaaS platforms, or enterprise IT environments.
Knowledge of security compliance and regulatory requirements relevant to infrastructure.

Challenges and Impact:
Balancing rapid feature delivery with system reliability and operational stability.
Managing complex, multi-platform, geographically distributed environments.
Driving automation and efficiency in a constantly evolving technical landscape.
Building strong relationships with stakeholders to ensure alignment and seamless service delivery.

LANGUAGE: French, English
Ability to communicate in English, both orally and in writing, is a requirement as the person in this position will need to collaborate regularly with colleagues and partners in the United States.

Ingénieur(e) senior en fiabilité de site (SRE):
En tant qu'ingénieur(e) senior en fiabilité de site, vous piloterez la conception, la mise en œuvre et la maintenance d'infrastructures et de services hautement fiables, évolutifs et performants. Vous collaborerez étroitement avec les équipes de développement pour garantir la fiabilité, les performances et la disponibilité du système, tout en favorisant l'automatisation et l'excellence opérationnelle sur l'ensemble de la plateforme.

Responsabilités principales:
Diriger la conception, le déploiement et l'exploitation de systèmes à grande échelle et tolérants aux pannes afin de garantir une disponibilité et des performances élevées.
Développer et mettre en œuvre l'automatisation pour rationaliser les processus de déploiement, de surveillance et de réponse aux incidents.
Surveiller l'état du système, analyser les indicateurs et identifier et résoudre proactivement les problèmes de fiabilité, d'évolutivité et de performance.
Collaborer avec les équipes d'ingénierie logicielle pour améliorer la conception du système, les pipelines de déploiement et les pratiques opérationnelles.
Gérer la réponse aux incidents, analyser les causes profondes et mettre en œuvre des mesures correctives pour éviter qu'ils ne se reproduisent.
Favoriser l'amélioration continue de l'efficacité, de la fiabilité et de l'évolutivité de l'infrastructure grâce à des solutions innovantes.
Documenter l'architecture système, les procédures opérationnelles et les bonnes pratiques afin de favoriser le partage des connaissances et la cohérence opérationnelle.
Encadrer et assurer le leadership technique des SRE juniors et des équipes transverses.
Participer aux rotations d'astreinte pour garantir la fiabilité du système 24h/24 et 7j/7 et la résolution rapide des incidents.
Collaborer avec les parties prenantes pour aligner les pratiques SRE sur les objectifs métier et les stratégies techniques.

Compétences et qualifications clés:
Vaste expérience en ingénierie de la fiabilité des sites, en ingénierie des systèmes ou dans des rôles connexes, généralement au moins 5 ans.
Maîtrise des plateformes cloud (AWS, Azure, Google Cloud) et des outils d'orchestration de conteneurs (Kubernetes, Docker).
Expertise en administration système Linux, réseaux et bonnes pratiques de sécurité.
Maîtrise des langages de programmation et de script tels que Python, Go, Bash ou similaires pour l'automatisation.
Expérience avec l'infrastructure en tant que code (Terraform, Ansible, CloudFormation) et les pipelines CI/CD.
Maîtrise approfondie des outils de surveillance, de journalisation et d'alerte (Prometheus, Grafana, pile ELK). Capacité avérée à concevoir et maintenir des systèmes distribués évolutifs et des architectures tolérantes aux pannes.
Solides compétences en résolution de problèmes et capacité à gérer des défis techniques complexes de manière autonome.
Excellentes compétences en communication pour collaborer efficacement avec les équipes et les fournisseurs externes.
Familiarité avec les cadres de gestion des incidents, les objectifs de niveau de service (SLO) et les accords de niveau de service (SLA).

Qualifications souhaitées:
Licence en informatique, en ingénierie ou dans un domaine technique connexe.
Certifications en technologies cloud (AWS Certified Solutions Architect, Google Professional Cloud Architect, etc.).
Expérience des services financiers, des plateformes SaaS à grande échelle ou des environnements informatiques d'entreprise.
Connaissance de la conformité en matière de sécurité et des exigences réglementaires applicables aux infrastructures.

Défis et impact:
Équilibrer la rapidité de livraison des fonctionnalités avec la fiabilité du système et la stabilité opérationnelle.
Gestion d'environnements complexes, multiplateformes et géographiquement dispersés.
Favoriser l'automatisation et l'efficacité dans un environnement technique en constante évolution.
Établir des relations solides avec les parties prenantes pour garantir l'harmonisation et une prestation de services fluide.

💡 Quick Summary

Seeking a career-building opportunity? The Senior Site Reliability Engineer position is now open for candidates interested in the Architect / Interior Designer Jobs sector. This role in Montréal offers a professional environment and growth potential.

Requirement Snapshot: Candidates should possess basic communication skills, a proactive attitude, and the ability to work in a team. Experience in Architect / Interior Designer Jobs is a plus.

Sponsored

Job Details

Company Name: CGI

Frequently Asked Questions

Click the Apply Now button on this page, login or register for free on CallCenterJob.co.in, fill in your name, mobile number, city, and experience, then submit your application. The recruiter will contact you directly.
The expected salary for Senior Site Reliability Engineer in Montréal is ₹50,400 - ₹80,640 (Est.) per month. Actual compensation may vary based on experience and negotiation.
No, Senior Site Reliability Engineer is an on-site position based in Montréal. Candidates must be able to commute or relocate to this location.
Basic communication skills, a proactive attitude, and the ability to work in a team are required for Senior Site Reliability Engineer. Previous experience in Architect / Interior Designer Jobs is a plus. Freshers may also apply depending on the employer's requirements.
Yes, CallCenterJob.co.in is completely free for job seekers. Never pay money to apply for any job. If anyone asks for payment to process your application, report it immediately using the "Report this Job" button.

Similar Openings

  • Architect / Interior Designer (1+ year experience) Prabhadevi

    Description • Position: Architect / Interior Designer* • Company: Studio Design Inc* At Studio Design Inc, we are seeking talented Architects / Interior Designers to join our dynamic design team. This is an exciting opportunity for both junior and se...

    Full Time / Part Time

    Salary Estimated: 24K to 32K

    Remote

    September 3, 2026


    Apply Now

  • Design Head – Retail Interior

    Job description Job Title: Interior Design Manager Department: Design Industry: Interior Design / Architecture Location: Bhiwandi Reports to: CEO Intrested Candidates Can Share Resume & Portfolio on WhatsApp - 8657005459 Job Summary: We are seeki...

    Full Time / Part Time

    Salary Estimated: 25K to 28K

    Remote

    September 3, 2026


    Apply Now

  • Interior Designer – Retail | Store Design

    Job Title: Interior Designer – Retail | Store Design | AutoCAD | 3D Design Location: Mumbai, Maharashtra Job Type: Full-time Job Description We are hiring a talented Interior Designer – Retail with experience in store design, retail space planning, a...

    Full Time / Part Time

    Salary Estimated: 17K to 26K

    Remote

    September 3, 2026


    Apply Now

  • Urgent Opening For Junior Interior Designer- Andheri East , Mumbai

    Degree/Diploma in Interior Design or related field • 1–3 years of experience • Proficiency in AutoCAD, SketchUp / 3ds Max / Lumion • Basic understanding of design principles and materials Required Candidate profile Junior Interior Designer who has go...

    Full Time / Part Time

    Salary Estimated: 18K to 24K

    Remote

    September 3, 2026


    Apply Now

  • Site Supervisor - (Calicut) Freshers

    Hi Connections!! Livspace #hiringalert About Livspace : Livspace is building the world's first end-to-end interior design platform out of India. We’re India's top online home improvement & interior destination for consumers and the world & fi...

    Full Time / Part Time

    Salary Estimated: 24K to 29K

    Remote

    September 3, 2026


    Apply Now

  • Junior Architect – Technical & Detailing

    We are hiring a Junior Architect to join our team in Guwahati, Assam. This position is suited for candidates with 1–2 years of professional experience in architecture or interior design, looking to develop their technical and execution capabilities w...

    Full Time / Part Time

    Salary Estimated: 21K to 23K

    Remote

    September 3, 2026


    Apply Now

×

Login to Apply

Don't have an account? Register here