Senior Site Reliability Engineer (Montreal)

Senior Site Reliability Engineer (Montreal)

05 Aug
|
Socket.dev
|
Montreal

05 Aug

Socket.dev

Montreal

Ingénieur(e) senior DevOps / SRE

Lieu : Montréal, QC — Sur site

Type : Temps plein

À propos de DeO

DeOS est une plateforme interactive edge de nouvelle génération qui permet une expérience de jeu instantanée et haute performance sur n’importe quel appareil.

Grâce à une technologie de streaming avancée et à un réseau edge mondial, DeOS élimine le besoin de consoles, d’ordinateurs haut de gamme ou de téléchargements. Les utilisateurs peuvent simplement cliquer et jouer.

Rejoignez DeOS pour contribuer à la construction et à la mise à l’échelle de l’infrastructure derrière une plateforme mondiale, distribuée et à faible latence. Dans ce rôle, vous contribuerez à l’automatisation, à la fiabilité, à la performance et à l’excellence opérationnelle, tout en aidant à définir les meilleures pratiques d’ingénierie au sein de l’entreprise.

Pourquoi rejoindre

Chez DeOS, vous aurez l’occasion de :

- Développer une technologie qui façonne l’avenir du cloud gaming.
- Travailler sur des systèmes critiques, performants et déployés à l’échelle mondiale.
- Avoir une réelle autonomie et un impact technique significatif.
- Rejoindre une équipe dynamique qui résout des défis d’ingénierie complexes.

Vos responsabilités

- Concevoir, développer et maintenir une infrastructure cloud-native évolutive.
- Construire et optimiser des environnements Kubernetes et des pipelines CI/CD.
- Piloter les initiatives d’Infrastructure as Code avec des outils tels que Terraform et Ansible.
- Améliorer la surveillance, l’observabilité, la sécurité et la fiabilité globale des systèmes.
- Encadrer les ingénieurs et contribuer à l’établissement des meilleures pratiques DevOps et SRE.
- Collaborer avec les équipes de développement afin de simplifier les déploiements et les opérations.
- Diagnostiquer et résoudre les incidents en production,



tout en soutenant des systèmes à haute disponibilité.

Profil

- 8 ans ou plus d’expérience en DevOps, SRE, ingénierie d’infrastructure ou dans un rôle connexe.
- Solides compétences en administration Linux et en scripting, notamment avec Bash, Python ou des langages similaires.
- Expertise approfondie de Kubernetes et de l’orchestration de conteneurs.
- Expérience avec les plateformes CI/CD et l’Infrastructure as Code.
- Connaissance pratique des plateformes cloud telles qu’AWS, GCP ou Azure.
- Familiarité avec les outils de surveillance et d’observabilité tels que Prometheus et Grafana.
- Solide compréhension des systèmes distribués, de la scalabilité, de l’automatisation et de l’ingénierie de fiabilité.
- Fortes capacités de résolution de problèmes et aptitude à travailler dans des environnements critiques de production.

Atouts

- Expérience avec l’infrastructure GPU ou les plateformes d’IA.
- Expérience dans le jeu vidéo, le streaming ou d’autres systèmes sensibles à la latence.
- Contributions à des projets open source liés à l’infrastructure.

Engineer

Location: Montreal, QC — Onsite

Type: Full-time

DeOS is a next-generation interactive edge platform enabling instant, high-performance gaming on any device. Powered by breakthrough streaming technology and a global edge network, DeOS eliminates the need for consoles, high-end PCs, or downloads. Users can simply click and play.

Why Join DeOS

At DeOS, you will build and scale the infrastructure behind a globally distributed,



low-latency platform. You will drive automation, reliability, performance, and operational excellence while helping define engineering best practices across the company.

- Build technology powering the future of cloud gaming.
- Work on globally scaled, performance-critical systems.
- Take ownership and have meaningful technical impact.
- Join a fast-moving team solving complex engineering challenges.

What You’ll Do

- Design, build, and maintain scalable cloud-native infrastructure.
- Build and optimize Kubernetes environments and CI/CD pipelines.
- Lead Infrastructure as Code initiatives using Terraform and Ansible.
- Improve monitoring, observability, security, and overall system reliability.
- Mentor engineers and help establish DevOps and SRE best practices.
- Collaborate with development teams to streamline deployments and operations.
- Troubleshoot production issues and support high-availability systems.

You Bring

- 8+ years of experience in DevOps, SRE, infrastructure engineering, or a related role.
- Solid Linux administration and scripting skills, including Bash, Python, or similar languages.
- Deep expertise with Kubernetes and container orchestration.
- Experience with CI/CD platforms and Infrastructure as Code.
- Hands-on knowledge of cloud platforms such as AWS, GCP, or Azure.
- Familiarity with monitoring and observability tools such as Prometheus, Grafana, or similar platforms.
- Solid understanding of distributed systems, scalability, automation, and reliability engineering.
- Strong problem-solving skills and the ability to work in production-critical environments.

Environments

- Nice to Have: Experience with GPU infrastructure or AI platforms. Background in gaming, streaming, or other latency-sensitive systems. Contributions to open-source infrastructure projects.

#J-18808-Ljbffr

📌 Senior Site Reliability Engineer (Montreal)
🏢 Socket.dev
📍 Montreal

Reply to this offer

Impress this employer describing Your skills and abilities, fill out the form below and leave Your personal touch in the presentation letter.

Subscribe to this job alert:

Get the latest job offers by email for: senior site reliability engineer (montreal) / montreal

Subscribe to this job alert:

Get the latest job offers by email for: senior site reliability engineer (montreal) / montreal