03 Oct
|
Intact Financial
|
Toronto
03 Oct
Intact Financial
Toronto
Nous vous promettons de vous soutenir et de vous offrir des occasions de développement et des avantages financiers axés sur la performance dans un milieu de travail où vous pouvez façonner l’avenir, réussir en équipe et évoluer avec nous.
Aménagements de travail flexibles et formule de travail hybride
Possibilité d’acheter jusqu’à cinq jours de vacances additionnels par année
Autres avantages sociaux visant à soutenir votre bien-être mental et physique, incluant des soins de santé virtuels, un compte de dépenses mieux-être, et plus encore.
RAAE et autres possibilités d’épargne : jusqu’à 12 % du salaire, voire plus (renseignez-vous sur la possibilité d’un revenu de retraite garanti à vie)
Boni annue l cible, basé sur le salaire de base, avec un versement potentiel pouvant aller jusqu’au double de la cible (selon la performance individuelle de l’employé et les résultats financiers de l’entreprise)
Pour honorer notre promesse de réussir en équipe, nous partageons les fruits de notre succès avec nos employés par l’entremise d’un programme de bonis annuels et d’un régime d’achat d’actions des employés (RAAE), dans le cadre duquel Intact verse une cotisation correspondant à 50 % des actions nettes achetées par l’employé.
Nos régimes de retraite sont flexibles et offrent une sécurité à long terme pour nos employés après leur carrière. Nous sommes l’une des rares entreprises à toujours offrir un régime de retraite à prestations déterminées qui assure un revenu de retraite garanti à vie.
Nous recherchons un(e) architecte de résilience pour définir et piloter notre architecture de résilience de bout en bout et notre stratégie de fiabilité en production sur nos environnement infonuagiques Azure, AWS, Google et nos environnements sur site.
La personne qui occupera ce rôle sera responsable des standards de conception, de la préparation à la mise en production et des mécanismes de contrôle à l'échelle de l'entreprise.
Le(la) candidat(e) idéal(e) combine une expertise en ingénierie de la fiabilité des sites (SRE), une maîtrise avancée de l'architecture système et une vision claire des pratiques d'ingénierie bleue/verte et de l'ingénierie du chaos, ainsi que de l'IA/IA générative, afin de garantir la fiabilité des systèmes, d'exploiter l'IA comme levier de résilience, de transformer les flux de travail des équipes et de de fournir aux utilisateurs des solutions résilientes et intelligentes.
Définir l'architecture de résilience à l’échelle de l'entreprise,
les modèles et les garde-fous de production pour toutes les plateformes et tous les services critiques.
Piloter la qualité de la conception par des revues d'architecture rigoureuses et des évaluations de préparation à la mise en production.
Intégrer l'IA/IA générative à l'ingénierie de la fiabilité : architectures de systèmes d'IA robustes, observabilité assistée par l'IA, détection causale et remédiation autonome.
Piloter l'évolution des stratégies de reprise après sinistre, de protection contre les logiciels de rançons (ransomwares) et de continuité d'activité, en s'appuyant sur des contrat de niveau de service / Objectif de niveau de service (SLA/SLO) stricts et des résultats d’affaires mesurables.
Définir l'architecture de référence de résilience pour les environnements infonuagiques/hybrides (disponibilité, latence, durabilité, Objectif de temps de restauration (RTO) / Objectif de point de reprise (RPO))
Mettre en place la gouvernance via des revues de conception, des points de contrôle de production, des politiques de sécurité, des tableaux de bord et des contrôles automatisés intégrés aux plateformes d’intégration et de déploiement continus (CI/CD), infrastructure en tant que code (IaC) et plateformes d'exécution.
Standardiser l'architecture de déploiement bleu/vert et concevoir des basculements de trafic sécurisés, des points de contrôle d'intégrité, des basculements progressifs, des restaurations et des migrations de données sans interruption de service.
Piloter un programme d'ingénierie du chaos à l'échelle de l'entreprise (expérimentations, injection de pannes, simulations) et intégrer les résultats dans les règles de l'architecture et l'amélioration des Objectif de niveau de service ( SLO).
Promouvoir l'observabilité et les pratiques en ingénierie de la fiabilité des sites (SRE) : adoption d'OpenTelemetry, traçage distribué, indicateur de niveau de service/ contrat de niveau de service / Objectif de niveau de service (SLI/SLA/SLO), budgets d'erreur et tableaux de bord de fiabilité pour la direction.
Concevoir l'architecture de reprise après sinistre (DR) et de cyber-résilience (sauvegardes immuables/isolées, PITR, segmentation résistante aux logiciels de rançons,
validation de la restauration) en conformité avec les exigences réglementaires et d'audit.
Garantir la résilience de la plateforme et des données sur Kubernetes/maillage (service Mesh) de services, la réplication/le consensus, la géodistribution et le flux d'événements (DLQ, gestion de la contre-pression, retraitement).
Assurer la fiabilité des systèmes d'IA/IA générative et des opérations pilotées par l'IA (surveillance/garde-fous, détection d'anomalies, modélisation prédictive, remédiation avec intervention humaine, copilotes opérationnels).
Plus de 10 ans d’expérience en ingénierie de fiabilité de sites (SRE)/Plateforme/Infrastructure/Architecture systèmes, avec une solide expérience des environnements de production critiques à grande échelle sur Azure, AWS, GCP et sur site.
Solutions d’observabilité : OpenTelemetry, Prometheus/Grafana, Jaeger/Tempo, ELK/OpenSearch, APM commerciaux ; Résilience des données : consensus/réplication (Raft/Paxos), partitionnement, PITR, snapshots, CDC ; caches (Redis), bases de données (Aurora, Cosmos DB, Spanner).
Bilinguisme (français et anglais) - Nécessite d'interagir sur une base régulière avec des collègues partout au pays.
Conception de systèmes d’IA fiables : déploiement de modèles (Ray/SageMaker/Vertex), bases de données vectorielles (Pinecone/FAISS/pgvector), pipelines de récupération, garde-fous et sécurité.
Apprentissage automatique en production (ML/Ops) : surveillance des modèles (dérive, performance, détection d’hallucinations), pipelines de fonctionnalités, traçabilité/observabilité, gouvernance des invites/du contenu.
Solides compétences en génie logiciel (Go/Python/TypeScript) et en pensée systémique ; Nous encourageons les candidatures de personnes appartenant à des groupes dignes d’équité, notamment les femmes, les Autochtones, les personnes handicapées, les personnes noires et les personnes faisant partie de la communauté 2ELGBTQI+.
Nous avons mis en place des politiques qui visent à assurer aux personnes handicapées l’égalité d’accès et de participation, entre autres grâce à des mesures d’adaptation (accommodements) en milieu de travail. Un exemplaire de ces politiques est disponible sur demande.
Si vous travaillez déjà pour Intact ou belairdirect, veuillez postuler à ce poste sur notre site carrière interne.
Merci de prendre note qu'Intact n'offre ni parrainage ni soutien concernant les démarches d'immigration, y compris, mais sans s'y limiter, les permis de travail fermés liés à l'entreprise.
📌 Un (e) Architecte F/H (Toronto)
🏢 Intact Financial
📍 Toronto