19 Aug
|
McKesson
|
Montreal
McKesson, l’une des 10 premières entreprises du classement Fortune Global 500, touche à pratiquement tous les aspects des soins de santé et s’emploie à faire une réelle différence. Nous sommes reconnus pour notre capacité à offrir un savoir, des produits et des services qui rendent les soins de qualité plus accessibles et plus abordables. Si tu souhaites dès aujourd’hui contribuer à la santé de demain, nous aimerions avoir de tes nouvelles.
McKesson is an impact-driven, Fortune 10 company that touches virtually every aspect of healthcare. We are known for delivering insights, products, and services that make quality care more accessible and affordable. Here, we focus on the health, happiness, and well‑being of you and those we serve – we care.
Together, we thrive as we shape the future of health for patients, our communities, and our people. If you want to be part of tomorrow’s health today, we want to hear from you.
Team/Project: Canada B2C Digital Solution. McKesson is seeking a Senior Lead Engineer, Platform Operations & Observability to lead the reliability, observability, and operational excellence of enterprise healthcare technology platforms. In this role, in accordance with Application Monitoring & Observability Lead, you will drive monitoring strategies, incident management practices, change governance, and root cause analysis initiatives while helping build scalable, secure, and resilient systems.
You will collaborate with software engineering, platform, security, and operations teams to improve service reliability, automate operational processes, and establish best practices for production readiness. This position also provides technical leadership and mentorship to engineering teams while influencing reliability standards and long‑term platform strategy. Lead monitoring and observability strategies across enterprise applications, platforms, and services.
Design, implement, and optimize dashboards, alerts, telemetry, logging, and performance monitoring solutions. Conduct root cause analysis (RCA) investigations and lead corrective and preventive action planning. Partner with engineering teams to improve platform reliability, resiliency, scalability, and operational readiness.
Lead change management reviews and promote safe deployment and release practices.
Ability to execute regression and validation test plans following each production deployment. Provide technical leadership, coaching, and mentoring to engineers while establishing engineering best practices. 7+ years of professional experience in Software Engineering, Site Reliability Engineering, Platform Engineering, DevOps, or related technical roles. ~ Bachelor’s degree in Computer Science, Engineering, Information Technology, or equivalent experience. ~ Hands‑on experience with monitoring, observability, logging, alerting, and application performance monitoring tools. ~ Experience performing root cause analysis and implementing preventive solutions. ~ Experience with CI/CD, automation, DevOps practices, and software delivery pipelines. ~ Demonstrated technical leadership and mentorship of engineering teams.
Strong analytical, troubleshooting, continuous improvement and stakeholder communication skills. Fair understanding and mastery of Ai tools (Copilot, Rovo) and Ai agents. Travel / Work Workplace / Physical Requirements Hybrid, two mandatory days at the Dobrin Office (Usually on Monday and Wednesday).
Ability to work at a computer for extended periods and participate in virtual collaboration activities. Participation in on‑call support and prod deployment rotations out of business hours may be required based on organizational needs.
À propos du poste Équipe / Projet : Solution numérique B2C Canada. Vous collaborerez avec les équipes d’ingénierie logicielle, de plateforme, de sécurité et d’exploitation afin d’améliorer la fiabilité des services, d’automatiser les processus opérationnels et d’établir les meilleures pratiques en matière de préparation à la production. Ce poste offre également un leadership technique et du mentorat aux équipes d’ingénierie tout en influençant les normes de fiabilité et la stratégie à long terme des plateformes.
Concevoir, mettre en œuvre et optimiser les tableaux de bord, alertes, solutions de télémétrie,
de journalisation et de surveillance de la performance. Collaborer avec les équipes d’ingénierie afin d’améliorer la fiabilité, la résilience, l’évolutivité et la préparation opérationnelle des plateformes. Fournir un leadership technique, de l’accompagnement et du mentorat aux ingénieurs tout en établissant les meilleures pratiques d’ingénierie.
Au moins 7 ans d’expérience professionnelle en ingénierie logicielle, ingénierie de fiabilité des sites (SRE), ingénierie de plateforme, DevOps ou dans des rôles techniques connexes. Baccalauréat en informatique, en génie, en technologies de l’information ou expérience équivalente. Expérience pratique avec les outils de surveillance, d’observabilité, de journalisation, d’alertes et de surveillance de la performance applicative.
Expérience en analyse des causes fondamentales et en mise en œuvre de solutions préventives. Expérience des pratiques CI/CD, de l’automatisation, du DevOps et des pipelines de livraison logicielle. Leadership technique démontré et expérience du mentorat auprès d’équipes d’ingénierie.
Solides compétences en analyse, dépannage, amélioration continue et communication avec les parties prenantes. Mode de travail hybride avec présence obligatoire deux jours par semaine au bureau de Dobrin (habituellement les lundis et mercredis). La participation à une rotation de garde et aux déploiements en production en dehors des heures normales de travail peut être requise selon les besoins de l’organisation This is determined by several factors, including performance, experience and skills, equity, regular job market evaluations, and geographical markets.
In addition to base pay, other compensation, such as an annual bonus or long‑term incentive opportunities may be offered. McKesson provides equal employment opportunities to applicants and employees, without regard to race, color, religion, sex, sexual orientation, gender identity, national origin, protected veteran status, disability, age, genetic information, or any other legally protected category. If you need a reasonable accommodation to assist with your job search or application for employment, please contact us by sending an email to (United States) Disability_Accommodation@McKesson.
📌 Senior Lead Engineer, Platform Operations & Observability/Ingénieur principal, Opérations de plateforme et observabilité (Montreal)
🏢 McKesson
📍 Montreal