17 Aug
|
Scientific Games
|
Montreal
17 Aug
Scientific Games
Montreal
Description du poste L''ingnieur en oprations techniques assure le soutien de niveau 2 pour la production, le soutien la mise en uvre et l''ingnierie de la fiabilit des plateformes de loterie et de services interactifs.
Ce poste garantit des oprations stables, scurises, observables et bien documentes dans des environnements Linux, Windows, de bases de donnes, d''applications, de rseau et adapts au cloud.
Ce profil modernis met l''accent sur les pratiques Dev
Ops et de fiabilit des sites : oprations axes sur l''automatisation, prise en charge des dploiements CI/CD, infrastructure en tant que code, dploiements contrls, observabilit, gestion des incidents, gestion de la configuration, hygine de scurit, ainsi que les oprations sur AWS ou en cloud hybride, le cas chant.
Ce poste peut tre combl Montral et/ou Winnipeg, selon les besoins de lorganisation et le lieu de rsidence des candidats retenus.
Responsabilits cls Assurer le soutien technique de niveau 2 pour les plateformes de transactions en temps rel, notamment le triage des incidents, le dpannage et la coordination des escalades avec le niveau 3, le dveloppement, l''assurance qualit, les fournisseurs et les oprations client.
Assurer le soutien des oprations de garde 24 heures sur 24, 7 jours sur 7, des fentres de maintenance planifie, des nouvelles mises en uvre, des refontes de systmes, de l''analyse des performances, des tests d''intgration, des tests de reprise aprs sinistre et des activits de basculement sur place.
Installer, configurer, appliquer des correctifs, scuriser et grer le cycle de vie des serveurs Linux et Windows, en mettant l''accent sur les environnements Ubuntu LTS et Red Hat Enterprise Linux (RHEL).
Automatisez les tches oprationnelles l''aide de Bash, Python, Power
Shell, Ansible, Terraform, SQL, Cloud
Formation ou d''outils quivalents afin de rduire les tches manuelles, d''uniformiser les environnements et d''amliorer la fiabilit.
Prise en charge des oprations sur AWS ou en cloud hybride, le cas chant, notamment EC2, RDS/Aurora PostgreSQL, S3, IAM, VPC, les groupes de scurit, les quilibreurs de charge, Route 53, Cloud
Watch, Systems Manager, KMS et Secrets Manager.
Soutenir les activits lies l''intgration continue et au dploiement continu (CI/CD) ainsi qu'' l''ingnierie des versions, notamment la prparation au dploiement, la validation des builds et des paquets, la mise en place des configurations, les concepts blue/green ou canary , la planification des retours en arrire et la vrification post-dploiement.
Surveiller l''tat des systmes et des bases de donnes, l''utilisation des serveurs, les certificats, le flux des transactions, les files d''attente et les retards, les journaux, les indicateurs de performance du nuage et la disponibilit des services ; grer les tableaux de bord, les alertes, les guides d''intervention et les procdures.
Effectuer des tches de soutien lies PostgreSQL/Postgres et aux SGBDR, telles que l''analyse des requtes, la coordination des sauvegardes et des restaurations, le soutien l''actualisation des donnes, le dpannage des connexions, l''valuation de la capacit et la collecte de preuves.
Assurer la scurit et l''hygine oprationnelle grce l''application de correctifs, la correction des vulnrabilits, la gestion des certificats SSL/TLS, le principe du moindre privilge, la configuration scurise, les concepts de chiffrement et la mise disposition de preuves d''audit.
Analyser les causes racines des problmes de performance, des checs de transaction, des anomalies de dploiement, des problmes lis au nuage, au rseau ou aux serveurs, ainsi que des incidents rcurrents ; communiquer les dtails techniques et les mesures correctives.
Exigences du poste / Qualifications requises Diplme d''tudes collgiales dans un domaine connexe requis ; diplme de premier cycle en informatique, en technologies de l''information, en gnie ou dans un domaine connexe, un atout.
Au moins 5 ans d''exprience dans le soutien oprationnel, le Dev
Ops, l''infrastructure, le soutien la production, les oprations dans le nuage ou l''ingnierie de la fiabilit pour des plateformes transactionnelles l''chelle de l''entreprise.
Une exprience dans les domaines des loteries, des jeux d''argent, des services financiers, du commerce lectronique ou d''autres environnements transactionnels rglements et haute disponibilit constitue un atout majeur.
Matrise de l''administration de Windows Server et de Linux, en particulier Ubuntu LTS et Red Hat Enterprise Linux, notamment en matire de dpannage, d''application de correctifs, de renforcement de la scurit et d''analyse des performances.
Connaissance de PostgreSQL/Postgres, RDS/Aurora PostgreSQL, SQL Server, MySQL, Oracle ou dautres bases de donnes relationnelles similaires, y compris les concepts lis au dpannage SQL et la maintenance oprationnelle.
Matrise de Python, Bash, Power
Shell, SQL, Ansible, Terraform, Cloud
Formation ou d''outils similaires pour la cration de scripting, le dbogage, l''automatisation et la collecte de preuves.
Une exprience avec AWS est un atout, notamment avec EC2, RDS/Aurora, S3, IAM, VPC/groupes de scurit, Cloud
Watch, Systems Manager, KMS, Secrets Manager, Route 53, l''quilibrage de charge, les instantans, ainsi que les concepts de haute disponibilit (HA) et de reprise aprs sinistre (DR).
Exprience en virtualisation, stockage, rseaux, certificats SSL/TLS, gestion des identits et des accs (IAM), scurit des systmes, outils de surveillance et dobservabilit, intgration continue et dploiement continu (CI/CD), ainsi que gestion des changements en production.
Comptences et aptitudes Solides comptences en analyse et en dpannage,
avec la capacit d''identifier les problmes au niveau des applications, des bases de donnes, du systme d''exploitation, du rseau, du stockage, de la gestion des identits et des accs (IAM), des services en nuage et des pipelines de dploiement.
Une communication claire, tant l''oral qu'' l''crit, comprenant notamment des mises jour concises sur l''tat d''avancement, des notes d''incident, des guides d''intervention, des preuves de modification et de la documentation technique destins des publics tant oprationnels que techniques.
Un esprit de collaboration et la capacit de travailler en partenariat avec les quipes des oprations, du dveloppement, de l''assurance qualit, des fournisseurs, de la scurit et celles en contact direct avec la clientle.
Une culture d''amlioration continue axe sur l''automatisation, la normalisation, la fiabilit, la scurit, l''observabilit, la prparation au cloud et l''excellence oprationnelle.
Capacit avre diagnostiquer et rsoudre des problmes techniques dans des environnements soumis une forte pression et ayant un impact sur les clients, tout en respectant les procdures de gestion des changements et en garantissant la traabilit. tre l''aise pour travailler au sein d''une quipe rpartie sur plusieurs sites gographiques et pour expliquer des concepts techniques complexes des intervenants non spcialiss.
Conditions de travail Participe un systme de rotation des gardes 24 heures sur 24, 7 jours sur 7, et assure un soutien en dehors des heures normales de travail pour les incidents, les mises en production, les fentres de maintenance, les tests de reprise aprs sinistre et les engagements envers les clients.
Peut fournir un soutien sur place lors des dploiements, des migrations, des tests de reprise aprs sinistre, des transitions vers le nuage ou les environnements hybrides, ainsi que lors des refontes de systmes.
Peut tre amen voyager au besoin pour apporter son soutien aux administrations charges des loteries, lors d''vnements lis la mise en uvre ou pour assurer la coordination avec les clients et les fournisseurs.
Environnement technique et outillage Systmes d''exploitation Ubuntu LTS, Red Hat Enterprise Linux (RHEL), Windows Server ; systemd, application de correctifs, renforcement de la scurit, analyse des logs, capacit et performance Bases de donnes PostgreSQL/Postgres, concepts de RDS/Aurora PostgreSQL, SQL Server, MySQL, Oracle ; dpannage des requtes, sauvegardes/restaurations, rplication et concepts lis la capacit Automatisation / Scripting Python, Bash, Power
Shell, SQL ; playbooks Ansible, modules Terraform, modles Cloud
Formation, API, automatisation des runbooks et outils oprationnels Dev
Ops / CI-CD Git, pipelines CI/CD, promotion d''artefacts/de paquets, portes de validation, validation du dploiement, concepts bleu/vert/canari, planification des rollback et collecte de preuves AWS / Cloud Connaissances souhaites : EC2, RDS/Aurora, S3, IAM, VPC, groupes de scurit, quilibreurs de charge, Route 53, Cloud
Watch, Systems Manager, KMS, Secrets Manager, instantans et concepts de haute disponibilit Conteneurs / Plateforme Connaissance des concepts Docker et Kubernetes ; une bonne matrise d''ECS/EKS est un atout ; dcouverte de services ; variables d''environnement/secrets et modles d''infrastructure immuable Observabilit Cloud
Watch, Prometheus, Grafana, Splunk, ELK/Open
Search ou leurs quivalents ; logs, mtriques, traces, tableaux de bord, configuration des alertes et rapports sur les SLO/SLA Scurit / Infrastructure IAM/principe du privilge minimal, certificats SSL/TLS, correction des vulnrabilits, rseaux, stockage, virtualisation, sauvegardes, reprise aprs sinistre, chiffrement, preuves d''audit et contrle des changements ____________________________________________________________________________________________________________________________________________________________ Job Description The Tech Ops Engineer provides Tier 2 production support, implementation support, and reliability engineering for lottery and interactive service platforms.
This role ensures stable, secure, observable, and well-documented operations across Linux, Windows, database, application, network, and cloud-aware environments.
The modernized profile emphasizes Dev
Ops and Site Reliability practices: automation-first operations, CI/CD release support, infrastructure as code, controlled deployments, observability, incident response, configuration management, security hygiene, and AWS or hybrid-cloud operations where applicable.
This position may be filled in Montreal and/or Winnipeg, based on organizational needs and the province of origin of the candidates.
Key Responsibilities Provide Tier 2 production support for real-time transaction platforms, including incident triage, troubleshooting, and escalation coordination with Tier 3, Development, QA, vendors, and customer operations.
Support 24x7 on-call operations, planned maintenance windows, new implementations, system overhauls, performance analysis, integration testing, DR tests, and in office cutover activities.
Install, configure, patch, harden, and lifecycle-manage Linux and Windows servers, with emphasis on Ubuntu LTS and Red Hat Enterprise Linux (RHEL) environments.
Automate operational tasks using Bash, Python,
Power
Shell, Ansible, Terraform, SQL, Cloud
Formation, or equivalent tools to reduce manual effort, standardize environments, and improve reliability.
Support AWS or hybrid-cloud operations where applicable, including EC2, RDS/Aurora PostgreSQL, S3, IAM, VPC, security groups, load balancers, Route 53, Cloud
Watch, Systems Manager, KMS, and Secrets Manager.
Support CI/CD and release engineering activities, including deployment readiness, build/package validation, configuration promotion, blue/green or canary concepts, rollback planning, and post-release verification.
Monitor system/database health, server utilization, certificates, transaction flow, queues/backlogs, logs, cloud metrics, and service availability; maintain dashboards, alerts, runbooks, and procedures.
Perform PostgreSQL/Postgres and RDBMS support tasks such as query analysis, backup/restore coordination, data refresh support, connection troubleshooting, capacity review, and evidence collection.
Maintain security and operational hygiene through patching, vulnerability remediation, SSL/TLS certificate management, least-privilege access, secure configuration, encryption concepts, and audit evidence support.
Investigate root causes for performance issues, transaction failures, deployment anomalies, cloud/network/server problems, and recurring incidents; communicate technical details and corrective actions.
Position Requirements / Qualifications Associate degree in a related field required; bachelor degree in Computer Science, Information Technology, Engineering, or a related field preferred.
Minimum 5 years of experience in operations support, Dev
Ops, infrastructure, production support, cloud operations, or reliability engineering for enterprise-scale transactional platforms.
Experience in lottery, gaming, financial services, e-commerce, or other regulated, high-availability transaction environments is a strong asset.
Proficient with Windows Server and Linux administration, especially Ubuntu LTS and Red Hat Enterprise Linux, including troubleshooting, patching, hardening, and performance analysis.
Familiarity with PostgreSQL/Postgres, RDS/Aurora PostgreSQL, SQL Server, MySQL, Oracle, or similar relational databases, including SQL troubleshooting and operational maintenance concepts.
Competence in Python, Bash, Power
Shell, SQL, Ansible, Terraform, Cloud
Formation, or similar tools for scripting, debugging, automation, and evidence collection. AWS experience is beneficial, particularly EC2, RDS/Aurora, S3, IAM, VPC/security groups, Cloud
Watch, Systems Manager, KMS, Secrets Manager, Route 53, load balancing, snapshots, HA and DR concepts.
Experience with virtualization, storage, networking, SSL/TLS certificates, IAM, system security, monitoring/observability tools, CI/CD, and production change control.
Skills and Competencies Strong analytical troubleshooting skills with the ability to isolate issues across application, database, operating system, network, storage, IAM, cloud-service, and deployment pipeline layers.
Clear verbal and written communication, including concise status updates, incident notes, runbooks, change evidence, and technical documentation for business and technical audiences.
Collaborative working style with the ability to partner with Operations, Development, QA, vendors, security, and customer-facing teams.
Continuous improvement mindset focused on automation, standardization, reliability, security, observability, cloud readiness, and operational excellence.
Proven ability to diagnose and resolve technical issues in high-pressure, customer-impacting environments while maintaining change discipline and auditability.
Comfortable working within a distributed team across multiple geographic locations and explaining complex technical concepts to non-technical stakeholders.
Working Conditions Participates in 24x7 on-call rotation and provides after-hours support for incidents, releases, maintenance windows, DR tests, and customer commitments.
May provide on-site support during implementations, conversions, disaster recovery tests, cloud/hybrid changes, and system overhauls.
May travel as needed to support lottery jurisdictions, implementation events, or customer/vendor coordination.
Technical Environment and Tooling Operating Systems Ubuntu LTS, Red Hat Enterprise Linux (RHEL), Windows Server; systemd, patching, hardening, log analysis, capacity and performance Databases PostgreSQL/Postgres, RDS/Aurora PostgreSQL concepts, SQL Server, MySQL, Oracle; query troubleshooting, backups/restores, replication and capacity concepts Automation / Scripting Python, Bash, Power
Shell, SQL; Ansible playbooks, Terraform modules, Cloud
Formation templates, APIs, runbook automation and operational tooling Dev
Ops / CI-CD Git, CI/CD pipelines, artifact/package promotion, release gates, deployment validation, blue/green/canary concepts, rollback planning and evidence collection AWS / Cloud Beneficial: EC2, RDS/Aurora, S3, IAM, VPC, security groups, load balancers, Route 53, Cloud
Watch, Systems Manager, KMS, Secrets Manager, snapshots and HA concepts Containers / Platform Docker, Kubernetes concepts, ECS/EKS familiarity beneficial, service discovery, environment variables/secrets and immutable infrastructure patterns Observability Cloud
Watch, Prometheus, Grafana, Splunk, ELK/Open
Search or equivalents; logs, metrics, traces, dashboards, alert tuning and SLO/SLA reporting Security / Infrastructure IAM/least privilege, SSL/TLS certificates, vulnerability remediation, networking, storage, virtualization, backups, DR, encryption, audit evidence and change control
📌 Tech Ops Engineer (Montreal)
🏢 Scientific Games
📍 Montreal