11 Sep
|
Aduna Global
|
Montreal
11 Sep
Aduna Global
Montreal
All Together, Extraordinary www.adunaglobal.com Aduna Global normalizes and proxies CAMARA Network APIs across multiple global CSPs. For our enterprise customers, latency, throughput, and error rates are the value proposition. We are hiring a senior backend engineer to own performance as a production engineering discipline: profiling live systems, shipping fixes to production, and keeping a multi-CSP platform fast and predictable at P99.
What This Role
Is (and Is Not) This is a software engineering role, not a QA or test-automation position.
You will work inside the production codebase: profiling, and modifying backend services, and owning performance fixes end to end. If you have shipped production code and been the engineer people call when “everything looks fine, but something is clearly wrong,” read on. What You’ll Do - Profile and root-cause performance issues in production across backend services, API gateway layers, and CSP integration paths, using flame graphs, distributed tracing, eBPF-based tooling, and low-level instrumentation.
- Ship performance fixes to production code: concurrency, connection management, caching, backpressure, and retry/timeout behavior.
- Drive tail-latency (P90/P99) optimization, including tail amplification and cross-CSP variability.
- Own error budgets and performance SLOs, partnering with engineering leadership to defend them.
- Design and build load-generation, benchmarking, and failure-injection infrastructure reflecting real enterprise traffic — nothing off-the-shelf fits a multi-CSP topology.
- Integrate automated performance-regression detection into CI/CD.
- Design telemetry instrumentation (New Relic or equivalent), internal dashboards, alerting logic, and anomaly-detection heuristics.
- Model and forecast capacity for multi-CSP API traffic, including peak-load behavior and regional variability.
- Lead post-incident reviews that produce architectural fixes, not just timelines.
What You
Bring - 5+ years building and operating production backend services in Go, Java, Python, or Node. You will read, profile, and fix production code, not report on it.
- Strong distributed-systems fundamentals: concurrency, backpressure, caching strategies, and failure modes.
- Deep understanding of HTTP/REST API performance: connection pooling, retries, timeouts, and cross-network latency behavior.
- Hands‑on profiling experience: eBPF-based profilers, flame graph analysis, CPU/memory profilers.
- Production observability experience (New Relic, Datadog, or similar), including designing instrumentation — not just consuming dashboards.
- [Add your core stack here, e.g., Kubernetes, gRPC, Kafka, PostgreSQL, so engineers can self‑select.] Bonus - Experience with high‑volume API platforms, telecom integrations, or CSP‑facing systems.
- SRE background: error budgets, chaos engineering, capacity planning at scale.
- Familiarity with CAMARA or other open telecom API standards.
You Might
Be a Fit If… - You get genuinely excited when a flame graph reveals a 40ms mystery you didn’t expect.
- You’ve been the person who gets called when “everything looks fine, but something is clearly wrong.” - You think in terms of tail latency, not averages, and you’ve argued (successfully) why that matters.
- You’ve built latency‑regression tooling from scratch because nothing off‑the‑shelf was good enough.
- You’ve hunted down performance debt proactively, long before customers felt the pain.
Why This Role Matters
Aduna abstracts global telecom complexity for enterprise developers via open CAMARA standards, delivering predictable, low‑latency APIs. Performance isn’t a metric here; it is the product. If you want to own performance at a company where your work is visible, measurable, and foundational, we’d like to meet you.
Why Join
Aduna?
- Build technology that impacts millions - Work with passionate, global teams - Growth in a fast‑moving, innovative workplace Our Offer:
- Hybrid model (3 days in our Montréal office) - Competitive salary + full benefits (dental, medical, RRSP/DPSP) - Unlimited PTO - High ownership, collaboration, and room to grow By applying, you consent to the processing of your personal data for recruitment purposes. Aduna is committed to a diverse and inclusive workplace. Tous ensemble, extraordinaires Aduna Global normalise et proxifie les APIs réseau CAMARA auprès de multiples CSPs à l’échelle mondiale. Pour nos clients enterprise, latence, débit et taux d’erreur ne sont pas des agréments — ils sont la proposition de valeur. Nous recrutons un(e) ingénieur(e) backend senior pour prendre en charge la performance en production: profiler des systèmes distribués, déployer des corrections et maintenir une plateforme multi‑CSP rapide et prévisible au P99. Ce que ce rôle est (et n’est pas) Il s’agit d’un rôle d’ingénierie logicielle, non d’assurance qualité. Vous travaillerez directement dans le code de production: profiler et modifier des services backend, prendre en charge les corrections de bout en bout. Si vous avez déployé du code en production et êtes la personne appelée quand «tout semble normal,
mais quelque chose ne va pas», lisez la suite. Ce que vous ferez - Profiler et analyser en profondeur les problèmes de performance en production à travers les services backend, les couches de passerelle API et les chemins d’intégration CSP, en utilisant des flame graphs, le tracing distribué, des outils basés sur eBPF et une instrumentation de bas niveau.
- Déployer des correctifs de performance dans le code de production: concurrence, gestion des connexions, mise en cache, contre‑pression, et comportement des mécanismes de retry/timeout.
- Piloter l’optimisation de la latence de queue (P90/P99), notamment l’amplification de queue et la variabilité inter‑CSP.
- Gérer les budgets d’erreur et les SLOs de performance, en partenariat avec la direction technique pour les défendre.
- Concevoir une infrastructure de benchmarking et d’injection de défaillances reflétant le trafic enterprise réel — aucune solution clé en main ne convient à une topologie multi‑CSP.
- Intégrer la détection automatique de régression de performance dans le CI/CD.
- Concevoir l’instrumentation de télémétrie (New Relic ou équivalent), les tableaux de bord internes, la logique d’alerting et les heuristiques de détection d’anomalies.
- Modéliser et prévoir le potentiel sur la capacité pour API multi‑CSP, notamment le comportement en pic de charge et la variabilité régionale.
- Piloter les post‑mortems pour produire des correctifs architecturaux durables, pas de simples chronologies. Ce que vous apportez - 5+ ans dans la création et l’exploitation de services backend en production en Go, Java, Python ou Node. Vous lirez, profilerez & corrigez du code de production, pas simplement le rendre compte, et utiliserez des techniques de benchmarking et d’observabilité.
- Solides fondamentaux en systèmes distribués: concurrence, contre‑pression, stratégies de mise en cache et modes de défaillance.
- Compréhension approfondie des performances des APIs HTTP/REST: pooling de connexions, retries, timeouts et comportement de la latence inter‑réseau.
- Expérience pratique du profiling: profileurs basés sur eBPF, analyse de flame graphs, profileurs CPU/mémoire.
- Expérience de l’observabilité en production (New Relic ou Datadog ou similaire), y compris la conception de l’instrumentation — pas seulement la consultation de dashboards.
- [Ajoutez ici votre stack technique principale, ex.: Kubernetes, gRPC, Kafka, PostgreSQL, afin que les ingénieurs puissent s’auto‑sélectionner.] En postulant, vous consentez à la collecte et au traitement de vos données personnelles à des fins de recrutement. Aduna s’engage en faveur d’un milieu de travail diversifié et inclusif.
📌 Senior Software Engineer, Performance / Ingénieur(e) Logiciel(le) Senior, Performance
🏢 Aduna Global
📍 Montreal