Architecte de résilience (Montreal)

Architecte de résilience (Montreal)

06 Oct
|
Intact Financial
|
Montreal

06 Oct

Intact Financial

Montreal

Nos équipes sont au coeur de tout ce que nous faisons. Ensemble, nous aidons les gens, les entreprises et la société à aller de lavant dans les bons moments et à être résilients dans les moments difficiles. Notre promesse aux employés, cest ce quIntact vous promet en échange de votre engagement à vivre nos valeurs, à donner le meilleur de vous-mêmes, à être ouverts au changement et à vous investir dans votre carrière. Nous vous promettons de vous soutenir et de vous offrir des occasions de développement et des avantages financiers axés sur la performance dans un milieu de travail où vous pouvez façonner lavenir, réussir en équipe et évoluer avec nous. La rémunération chez Intact, cest plus quune paie. Aménagements de travail flexibles et formule de travail hybride Possibilité dacheter jusquà cinq jours de vacances additionnels par année Autres avantages sociaux visant à soutenir votre bien-être mental et physique, incluant des soins de santé virtuels, un compte de dépenses mieux-être, et plus encore. RAAE et autres possibilités dépargne : jusquà 12 % du salaire, voire plus (renseignez-vous sur la possibilité dun revenu de retraite garanti à vie) Échelle salariale (sans sy limiter) :149,600 - 182,800 Boni annue l cible, basé sur le salaire de base, avec un versement potentiel pouvant aller jusquau double de la cible (selon la performance individuelle de lemployé et les résultats financiers de lentreprise)15% Pour honorer notre promesse de réussir en équipe, nous partageons les fruits de notre succès avec nos employés par lentremise dun programme de bonis annuels et dun régime dachat dactions des employés (RAAE), dans le cadre duquel Intact verse une cotisation correspondant à 50 % des actions nettes achetées par lemployé. Nos régimes de retraite sont flexibles et offrent une sécurité à long terme pour nos employés après leur carrière. Nous sommes lune des rares entreprises à toujours offrir un régime de retraite à prestations déterminées qui assure un revenu de retraite garanti à vie. Le salaire de la personne retenue pour ce poste sera déterminé selon un ensemble de facteurs, dont : lexpérience professionnelle, les compétences, la contribution anticipée quant au poste, léquité interne, etc. Léchelle salariale présentée ci-haut est pour une semaine de travail de 35 heures et pourrait sappliquer à la majorité des différents profils de candidats, mais nous encourageons les candidats se situant en dehors de cette zone salariale à postuler. À propos du poste Nous recherchons un(e) architecte de résilience pour définir et piloter notre architecture de résilience de bout en bout et notre stratégie de fiabilité en production sur nos environnement infonuagiques Azure, AWS, Google et nos environnements sur site. La personne qui occupera ce rôle sera responsable des standards de conception, de la préparation à la mise en production et des mécanismes de contrôle à léchelle de lentreprise. Le(la) candidat(e) idéal(e) combine une expertise en ingénierie de la fiabilité des sites (SRE), une maîtrise avancée de larchitecture système et une vision claire des pratiques dingénierie bleue/verte et de lingénierie du chaos, ainsi que de lIA/IA générative, afin de garantir la fiabilité des systèmes,



dexploiter lIA comme levier de résilience, de transformer les flux de travail des équipes et de de fournir aux utilisateurs des solutions résilientes et intelligentes. Ce que vous accomplirez chez nous : Objectifs principaux : Définir larchitecture de résilience à léchelle de lentreprise, les modèles et les garde-fous de production pour toutes les plateformes et tous les services critiques. Piloter la qualité de la conception par des revues darchitecture rigoureuses et des évaluations de préparation à la mise en production. Faire des déploiements bleu/vert et de lingénierie du chaos des pratiques de premier-plan, formalisées et codifiées à léchelle de lentreprise : conception, outillage, automatisation et validation continue. Intégrer lIA/IA générative à lingénierie de la fiabilité : architectures de systèmes dIA robustes, observabilité assistée par lIA, détection causale et remédiation autonome. Piloter lévolution des stratégies de reprise après sinistre, de protection contre les logiciels de rançons (ransomwares) et de continuité dactivité, en sappuyant sur des contrat de niveau de service / Objectif de niveau de service (SLA/SLO) stricts et des résultats daffaires mesurables. Responsabilités principales Définir larchitecture de référence de résilience pour les environnements infonuagiques/hybrides (disponibilité, latence, durabilité, Objectif de temps de restauration (RTO) / Objectif de point de reprise (RPO Mettre en place la gouvernance via des revues de conception, des points de contrôle de production, des politiques de sécurité, des tableaux de bord et des contrôles automatisés intégrés aux plateformes dintégration et de déploiement continus (CI/CD), infrastructure en tant que code (Ia C) et plateformes dexécution. Standardiser larchitecture de déploiement bleu/vert et concevoir des basculements de trafic sécurisés, des points de contrôle dintégrité, des basculements progressifs, des restaurations et des migrations de données sans interruption de service. Piloter un programme dingénierie du chaos à léchelle de lentreprise (expérimentations, injection de pannes, simulations) et intégrer les résultats dans les règles de larchitecture et lamélioration des Objectif de niveau de service ( SLO). Définir les standards de préparation à la mise en production (capacité/saturation, dégradation progressive, tentatives de redémarrage/délai, disjoncteurs, limitation de débit) et formaliser les procédures opérationnelles, les cartographies de dépendances et les topologies de basculement validées par des exercices et des simulations de reprise après sinistre. Promouvoir lobservabilité et les pratiques en ingénierie de la fiabilité des sites (SRE) : adoption dOpen Telemetry, traçage distribué,



indicateur de niveau de service/ contrat de niveau de service / Objectif de niveau de service (SLI/SLA/SLO), budgets derreur et tableaux de bord de fiabilité pour la direction. Concevoir larchitecture de reprise après sinistre (DR) et de cyber-résilience (sauvegardes immuables/isolées, PITR, segmentation résistante aux logiciels de rançons, validation de la restauration) en conformité avec les exigences réglementaires et daudit. Garantir la résilience de la plateforme et des données sur Kubernetes/maillage (service Mesh) de services, la réplication/le consensus, la géodistribution et le flux dévénements (DLQ, gestion de la contre-pression, retraitement). Assurer la fiabilité des systèmes dIA/IA générative et des opérations pilotées par lIA (surveillance/garde-fous, détection danomalies, modélisation prédictive, remédiation avec intervention humaine, copilotes opérationnels). Assurer le rôle de référent(e) en matière de résilience : encadrer les équipes, animer les comités/forums et communiquer clairement les compromis aux dirigeants et aux ingénieurs. Ce que vous mettrez à profit : Plus de 10 ans dexpérience en ingénierie de fiabilité de sites (SRE)/Plateforme/Infrastructure/Architecture systèmes, avec une solide expérience des environnements de production critiques à grande échelle sur Azure, AWS, GCP et sur site. Gestion du trafic multirégional, équilibrage de charge global, DNS/BGP, TLS/m TLS, CDN/Edge. Écosystèmes Kubernetes (AKS/EKS/GKE), maillages de services (Istio/Linkerd), stratégies dautoscaling, disponibilité, contraintes de topologie. Solutions dobservabilité : Open Telemetry, Prometheus/Grafana, Jaeger/Tempo, ELK/Open Search, APM commerciaux ; modélisation de la corrélation et de la topologie. Résilience des données : consensus/réplication (Raft/Paxos), partitionnement, PITR, snapshots, CDC ; caches (Redis), bases de données (Aurora, Cosmos DB, Spanner). Infrastructure en tant que code (Ia C) et automatisation : Terraform/Pulumi, Git Ops (Argo CD/Flux), politiques en tant que code (OPA), modèles dintégration et de déploiement continus (CI/CD) (déploiement bleu/vert, déploiement canary, déploiement progressif). Ingénierie du chaos, orchestration de la reprise après sinistre et basculement automatisé à léchelle de lentreprise. Aucune expérience de travail au Canada requise, mais nécessité davoir lautorisation de travailler au Canada. Bilinguisme (français et anglais) - Nécessite dinteragir sur une base régulière avec des collègues partout au pays. Compétences en IA/IA générale : Conception de systèmes dIA fiables : déploiement de modèles (Ray/Sage Maker/Vertex), bases de données vectorielles (Pinecone/FAISS/pgvector), pipelines de récupération, garde-fous et sécurité. Apprentissage automatique en production (ML/Ops) : surveillance des modèles (dérive, performance, détection dhallucinations), pipelines de fonctionnalités, traçabilité/observabilité, gouvernance des invites/du contenu. Application de lIA aux opérations : détection causale, résilience prédictive, cadres de remédiation autonomes. Solides compétences en génie logiciel (Go/Python/Type Script) et en pensée systémique ; excellente communication (écrite, visuelle, verbale) et présence de direction. . click apply for full job details

📌 Architecte de résilience (Montreal)
🏢 Intact Financial
📍 Montreal

Reply to this offer

Impress this employer describing Your skills and abilities, fill out the form below and leave Your personal touch in the presentation letter.

Subscribe to this job alert:

Get the latest job offers by email for: architecte de résilience (montreal) / montreal

Subscribe to this job alert:

Get the latest job offers by email for: architecte de résilience (montreal) / montreal