Senior Lead Engineer, Platform Operations & Observability/Ingénieur principal, Opérations de pl[...] (Montreal)

Senior Lead Engineer, Platform Operations & Observability/Ingénieur principal, Opérations de pl[...] (Montreal)

30 Aug
|
McKesson
|
Montreal

30 Aug

McKesson

Montreal

McKesson, l’une des 10 premieres entreprises du classement Fortune Global 500, touche a pratiquement tous les aspects des soins de sante et s’emploie a faire une reelle difference. Nous sommes reconnus pour notre capacite a offrir un savoir, des produits et des services qui rendent les soins de qualite plus accessibles et plus abordables. Chez nous, la sante, le bonheur et le bien‑etre de nos gens et des personnes que nous desservons sont prioritaires—et nous tiennent a cœur.

Ce que tu fais chez McKesson a de l’importance. Nous favorisons une culture ou tu peux t’epanouir et avoir un impact, et ou tu es encourage a proposer de nouvelles idees. Ensemble, nous façonnons l’avenir de la sante pour nos patients, nos communautes et nos equipes. Si tu souhaites des aujourd’hui contribuer a la sante de demain, nous aimerions avoir de tes nouvelles.

McKesson is an impact-driven, Fortune 10 company that touches virtually every aspect of healthcare. We are known for delivering insights, products, and services that make quality care more accessible and affordable. Here, we focus on the health, happiness, and well‑being of you and those we serve – we care.

What you do at McKesson matters. We foster a culture where you can grow, make an impact, and are empowered to bring new ideas. Together, we thrive as we shape the future of health for patients, our communities, and our people. If you want to be part of tomorrow’s health today, we want to hear from you.

About The Role

Team/Project: Canada B2C Digital Solution. Main application in the portfolio is a B2C Platform for pharmacy patients. Team of around 20 people.

McKesson is seeking a Senior Lead Engineer, Platform Operations & Observability to lead the reliability, observability, and operational excellence of enterprise healthcare technology platforms. In this role, in accordance with Application Monitoring & Observability Lead, you will drive monitoring strategies, incident management practices, change governance, and root cause analysis initiatives while helping build scalable, secure, and resilient systems.

You will collaborate with software engineering, platform, security, and operations teams to improve service reliability, automate operational processes, and establish best practices for production readiness. This position also provides technical leadership and mentorship to engineering teams while influencing reliability standards and long‑term platform strategy.

What You’ll Do

  • Lead monitoring and observability strategies across enterprise applications, platforms, and services.
  • Design, implement, and optimize dashboards, alerts, telemetry, logging, and performance monitoring solutions.
  • Drive incident management processes, major incident response, escalation coordination, service restoration activities and postmortem incident.
  • Conduct root cause analysis (RCA) investigations and lead corrective and preventive action planning.
  • Partner with engineering teams to improve platform reliability, resiliency, scalability, and operational readiness.
  • Lead change management reviews and promote safe deployment and release practices.
  • Ability to execute regression and validation test plans following each production deployment.
  • Provide technical leadership, coaching, and mentoring to engineers while establishing engineering best practices.
  • Influence architecture, automation, CI/CD, and operational excellence initiatives supporting enterprise platforms.

Basic Requirements

  • 7+ years of professional experience in Software Engineering, Site Reliability Engineering, Platform Engineering, DevOps, or related technical roles.
  • Bachelor's degree in Computer Science, Engineering, Information Technology, or equivalent experience.
  • Experience supporting large‑scale production environments and enterprise applications.
  • Hands‑on experience with monitoring, observability, logging, alerting, and application performance monitoring tools.
  • Proven experience leading incident management and production support activities.
  • Experience performing root cause analysis and implementing preventive solutions.
  • Experience with CI/CD, automation, DevOps practices, and software delivery pipelines.
  • Experience with microservices, APIs, distributed systems,



    and cloud‑based architectures.
  • Lead production readiness reviews and operational acceptance activities prior to major releases.

Preferred Skills / Experience

  • Experience with tools such as Dynatrace, Prometheus, Dotcom Monitor or similar observability platforms.
  • Experience with Kubernetes, containers, and cloud platforms such as Azure.
  • Knowledge of ITIL‑aligned incidents, problems, and change management practices.
  • Experience defining SLAs, MTTR and service reliability metrics.
  • Demonstrated technical leadership and mentorship of engineering teams.
  • Experience operating in regulated or highly compliant environments.
  • Experience driving platform modernization and operational excellence initiatives.
  • Robust analytical, troubleshooting, continuous improvement and stakeholder communication skills.
  • Fair understanding and mastery of AI tools (Copilot, Rovo) and AI agents.

Travel / Work Environment / Physical Requirements

  • Hybrid, two mandatory days at the Dobrin Office (Usually on Monday and Wednesday).
  • Ability to work at a computer for extended periods and participate in virtual collaboration activities.
  • Participation in on‑call support and prod deployment rotations out of business hours may be required based on organizational needs.

À propos du poste

Équipe / Projet : Solution numerique B2C Canada. La principale application du portefeuille est une plateforme B2C destinee aux patients en pharmacie. L’equipe est composee d’environ 20 personnes.

McKesson est a la recherche d’un Ingenieur principal responsable, Operations de plateforme et observabilite pour diriger la fiabilite, l’observabilite et l’excellence operationnelle des plateformes technologiques de sante de l’entreprise. Dans ce role, en collaboration avec le responsable de la surveillance applicative et de l’observabilite, vous dirigerez les strategies de surveillance, les pratiques de gestion des incidents, la gouvernance des changements et les initiatives d’analyse des causes fondamentales, tout en contribuant a la creation de systemes evolutifs, securises et resilients. Vous collaborerez avec les equipes d’ingenierie logicielle, de plateforme, de securite et d’exploitation afin d’ameliorer la fiabilite des services, d’automatiser les processus operationnels et d’etablir les meilleures pratiques en matiere de preparation a la production. Ce poste offre egalement un leadership technique et du mentorat aux equipes d’ingenierie tout en influençant les normes de fiabilite et la strategie a long terme des plateformes.

Ce que vous ferez

  • Diriger les strategies de surveillance et d’observabilite a travers les applications, plateformes et services de l’entreprise.
  • Concevoir, mettre en œuvre et optimiser les tableaux de bord, alertes, solutions de telemetrie, de journalisation et de surveillance de la performance.
  • Piloter les processus de gestion des incidents, la reponse aux incidents majeurs, la coordination des escalades, les activites de retablissement des services et les analyses post‑incident.
  • Realiser des analyses des causes fondamentales (RCA) et diriger la planification des actions correctives et preventives.
  • Collaborer avec les equipes d’ingenierie afin d’ameliorer la fiabilite, la resilience, l’evolutivite et la preparation operationnelle des plateformes.
  • Diriger les revues de gestion des changements et promouvoir des pratiques securitaires de deploiement et de mise en production.
  • Être en mesure d’executer des plans de tests de regression et de validation apres chaque deploiement en production.
  • Fournir un leadership technique, de l’accompagnement et du mentorat aux ingenieurs tout en etablissant les meilleures pratiques d’ingenierie.
  • Influencer les initiatives liees a l’architecture, a l’automatisation,



    au CI/CD et a l’excellence operationnelle soutenant les plateformes d’entreprise.

Exigences de base

  • Au moins 7 ans d’experience professionnelle en ingenierie logicielle, ingenierie de fiabilite des sites (SRE), ingenierie de plateforme, DevOps ou dans des roles techniques connexes.
  • Baccalaureat en informatique, en genie, en technologies de l’information ou experience equivalente.
  • Experience du soutien d’environnements de production a grande echelle et d’applications d’entreprise.
  • Experience pratique avec les outils de surveillance, d’observabilite, de journalisation, d’alertes et de surveillance de la performance applicative.
  • Experience demontree dans la gestion des incidents et le soutien aux environnements de production.
  • Experience en analyse des causes fondamentales et en mise en œuvre de solutions preventives.
  • Experience des pratiques CI/CD, de l’automatisation, du DevOps et des pipelines de livraison logicielle.
  • Experience avec les microservices, les API, les systemes distribues et les architectures infonuagiques.
  • Diriger les revues de preparation a la production et les activites d’acceptation operationnelle avant les mises en production majeures.

Competences et experience privilegiees

  • Experience avec des outils tels que Dynatrace, Prometheus, Dotcom Monitor ou d’autres plateformes d’observabilite similaires.
  • Experience avec Kubernetes, les conteneurs et des plateformes infonuagiques telles qu’Azure.
  • Connaissance des pratiques de gestion des incidents, des problemes et des changements alignees sur ITIL.
  • Experience dans la definition des SLA, du MTTR et des indicateurs de fiabilite des services.
  • Leadership technique demontre et experience du mentorat aupres d’equipes d’ingenierie.
  • Experience dans des environnements reglementes ou soumis a des exigences elevees de conformite.
  • Experience dans la modernisation des plateformes et la mise en œuvre d’initiatives d’excellence operationnelle.
  • Solides competences en analyse, depannage, amelioration continue et communication avec les parties prenantes.
  • Bonne comprehension et maitrise des outils d’IA (Copilot, Rovo) ainsi que des agents d’IA.

Deplacements / Environnement de travail / Exigences physiques

  • Mode de travail hybride avec presence obligatoire deux jours par semaine au bureau de Dobrin (habituellement les lundis et mercredis).
  • Capacite a travailler devant un ordinateur pendant de longues periodes et a participer a des activites de collaboration virtuelle.
  • La participation a une rotation de garde et aux deploiements en production en dehors des heures normales de travail peut etre requise selon les besoins de l’organisation

We are proud to offer a competitive compensation package at McKesson as part of our Total Rewards. This is determined by several factors, including performance, experience and skills, equity, regular job market evaluations, and geographical markets. The pay range shown below is aligned with McKesson's pay philosophy, and pay will always be compliant with any applicable regulations. In addition to base pay, other compensation, such as an annual bonus or long‑term incentive opportunities may be offered. For more information regarding benefits at McKesson, please click here.

Notre echelle salariale de base pour ce poste

Our Base Pay Range for this position

$94,400 - $157,300

McKesson is an Equal Prospect Employer

McKesson provides equal employment opportunities to applicants and employees, without regard to race, color, religion, sex, sexual orientation, gender identity, national origin, protected veteran status, disability, age, genetic information, or any other legally protected category. For additional information on McKesson’s full Equal Employment Opportunity policies, visit our Equal Employment Opportunity page.

McKesson is committed to being an Equal Employment Prospect Employer and offers opportunities to all job seekers including job seekers with disabilities. If you need a reasonable accommodation to assist with your job search or application for employment, please contact us by sending an email to (United States) or (Canada) Resumes or CVs submitted to this email box will not be accepted.

Join us at McKesson!

#J-18808-Ljbffr

📌 Senior Lead Engineer, Platform Operations & Observability/Ingénieur principal, Opérations de pl[...] (Montreal)
🏢 McKesson
📍 Montreal

Reply to this offer

Impress this employer describing Your skills and abilities, fill out the form below and leave Your personal touch in the presentation letter.

Subscribe to this job alert:

Get the latest job offers by email for: senior lead engineer, platform operations & observability/ingénieur principal, opérations de pl[...] (montreal) / montreal

Subscribe to this job alert:

Get the latest job offers by email for: senior lead engineer, platform operations & observability/ingénieur principal, opérations de pl[...] (montreal) / montreal