Principal Machine Learning Developer, AI/ML Platform (Toronto)

Principal Machine Learning Developer, AI/ML Platform (Toronto)

02 Oct
|
Autodesk
|
Toronto

02 Oct

Autodesk

Toronto

Job Requisition ID #

26WD99908

L'affichage de poste en français suivra / The French job posting follows.

Principal Machine Learning Operations Developer, AI/ML Platform

Position Overview

Autodesk, a global leader in 3D design, engineering, manufacturing, and entertainment software, is seeking a skilled Principal MLOps Developer to join our AI/ML Platform team. This role is pivotal in ensuring the smooth operationalization of machine learning models and the overall efficiency of our next-generation AI/ML platform used in the development of machine learning and generative AI solutions powering Autodesk’s suite of products and services. You will collaborate with research and product engineering from various domains including design, construction, manufacturing, and media & entertainment to deliver platform capabilities that support the full AI/ML development lifecycle.

As a principal-level contributor, you will help build innovative capabilities that enable faster, more secure development and deployment of machine learning and generative AI solutions. You will take ownership of critical platform components, provide architectural direction, and contribute to scalable systems for model training, inference, data processing, deployment automation, monitoring, governance, and operations.

Location: Canada. Open to Toronto, Ontario or Remote Ontario.

Responsibilities

- Drive the operational excellence and technical direction of our AI/ML Platform by implementing and optimizing MLOps practices across the full machine learning development lifecycle
- Lead the design and engineering of software systems and platform services for the AI/ML Platform, contributing to scalable, secure, and reliable ML development and operations
- Design and implement automated deployment pipelines for machine learning models and ML artifacts, ensuring seamless transitions from development to production
- Develop comprehensive systems to automate and optimize laborious ML development and operational processes, integrating them into the platform to streamline operations
- Collaborate with cross-functional teams to design, implement, and maintain scalable infrastructure for model training, inference, data processing, and ML artifact management
- Develop tools for building, deploying, and operating ML artifacts in production environments, facilitating a smooth transition from development to deployment
- Automate and orchestrate tasks related to managing large-scale data transformation, data processing, and data stores that support model training, validation, deployment, and operations
- Design and implement low-latency, scalable prediction and inference services to support the diverse needs of platform users and Autodesk product teams
- Develop and maintain robust monitoring and logging systems to track model performance, system health, operational reliability, and overall platform efficiency
- Work closely with data developers to ensure efficient data pipelines for model training, validation, deployment, and ongoing platform operations
- Collaborate across diverse teams, including machine learning researchers, data developers, software developers, product managers, software architects, and operations teams, fostering a collaborative and cohesive work environment
- Implement version control systems for machine learning models and contribute to model governance practices
- Contribute to the implementation of robust model governance practices, version control systems, and adherence to compliance standards. Uphold data privacy and ethical considerations, fostering trust in our AI/ML solutions
- Enforce security best practices and compliance standards in all aspects of MLOps, ensuring data privacy and platform security
- Identify opportunities for process automation and optimization, and implement strategies to enhance the overall MLOps lifecycle
- Take ownership of critical components of the platform, providing architectural direction and contributing to the overall success of the AI/ML Platform

Minimum Qualifications

- BS or MS in Computer Science, or equivalent practical experience
- Experience: 8+ years of experience in software development and engineering, with a solid record of delivering production systems and services
- Strong background in AI/ML with experience in deep learning, statistical modeling, and neural networks
- Hands-on experience with AI/ML frameworks (such as TensorFlow, PyTorch) and familiarity with the lifecycle of AI/ML model development, from training to deployment
- Strong coding skills in languages commonly used in AI/ML and system development, such as Python, Java, or Go
- Ability to tackle complex technical challenges, analyze potential solutions, and implement the most effective ones
- Strong communication skills to effectively collaborate with cross-functional teams, along with the ability to work independently
- Deep understanding of performance metrics and latency optimization techniques, with the ability to diagnose, tune, and enhance the efficiency of serving systems
- A continuous learning mindset to stay updated with the latest trends and technologies in AI/ML,



cloud computing, and software engineering

Preferred Qualifications

- Exposure to leveraging GPU computing for AI/ML workloads, including experience with CUDA, OpenCL, or other GPU programming tools, to significantly enhance model training and inference performance
- Experience with big data technologies and ecosystems (Hadoop, Spark, Kafka) for processing and analyzing large datasets in a distributed computing workplace
- Familiarity with tools and frameworks for monitoring and managing the performance of AI/ML models in production (e.g., MLflow, Kubeflow, TensorBoard)
- Experience with HPC techniques and technologies for optimizing computational workloads, particularly in the context of AI/ML model training and inference

Développeur principal MLOps, plateforme IA/ML

Aperçu du poste

Autodesk, leader mondial des logiciels de conception 3D, d'ingénierie, de fabrication et de divertissement, recherche un développeur MLOps principal expérimenté pour rejoindre notre équipe chargée de la plateforme IA/ML. Ce poste est essentiel pour garantir la mise en œuvre sans heurts des modèles d’apprentissage automatique et l’efficacité globale de notre plateforme IA/ML de nouvelle génération, utilisée dans le développement de solutions d’apprentissage automatique et d’IA générative qui alimentent la suite de produits et de services d’Autodesk. Vous collaborerez avec les équipes de recherche et d’ingénierie produit issues de divers domaines, notamment la conception, la construction, la fabrication, ainsi que les médias et le divertissement, afin de fournir des fonctionnalités de plateforme prenant en charge l’ensemble du cycle de vie du développement IA/ML.

En tant que collaborateur de niveau principal, vous contribuerez à la mise en place de fonctionnalités innovantes permettant un développement et un déploiement plus rapides et plus sécurisés des solutions d’apprentissage automatique et d’IA générative. Vous serez responsable de composants critiques de la plateforme, fournirez des orientations architecturales et contribuerez à la mise en place de systèmes évolutifs pour l’entraînement des modèles, l’inférence, le traitement des données, l’automatisation du déploiement, la surveillance, la gouvernance et les opérations.

Lieu : Canada. Poste ouvert à Toronto (Ontario) ou en télétravail depuis l’Ontario.

Responsabilités

- Assurer l’excellence opérationnelle et l’orientation technique de notre plateforme IA/ML en mettant en œuvre et en optimisant les pratiques MLOps tout au long du cycle de vie complet du développement de l’apprentissage automatique
- Diriger la conception et l’ingénierie des systèmes logiciels et des services de la plateforme IA/ML, en contribuant à un développement et à des opérations ML évolutifs, sécurisés et fiables
- Concevoir et mettre en œuvre des pipelines de déploiement automatisés pour les modèles d’apprentissage automatique et les artefacts ML, en garantissant des transitions fluides du développement à la production
- Développer des systèmes complets pour automatiser et optimiser les processus laborieux de développement et d’exploitation du ML, en les intégrant à la plateforme afin de rationaliser les opérations
- Collaborer avec des équipes interfonctionnelles pour concevoir, mettre en œuvre et maintenir une infrastructure évolutive pour l’entraînement des modèles, l’inférence, le traitement des données et la gestion des artefacts ML
- Développer des outils pour la création, le déploiement et l’exploitation d’artefacts ML dans des environnements de production, facilitant ainsi une transition en douceur du développement au déploiement
- Automatiser et orchestrer les tâches liées à la gestion de la transformation de données à grande échelle, du traitement des données et des référentiels de données qui prennent en charge l’entraînement, la validation, le déploiement et l’exploitation des modèles
- Concevoir et mettre en œuvre des services de prédiction et d’inférence à faible latence et évolutifs afin de répondre aux divers besoins des utilisateurs de la plateforme et des équipes produit d’Autodesk
- Développer et maintenir des systèmes robustes de surveillance et de journalisation pour suivre les performances des modèles, l’état de santé du système, la fiabilité opérationnelle et l’efficacité globale de la plateforme
- Travailler en étroite collaboration avec les développeurs de données afin de garantir l’efficacité des pipelines de données pour l’entraînement, la validation, le déploiement des modèles et l’exploitation continue de la plateforme




- Collaborer avec diverses équipes, notamment les chercheurs en apprentissage automatique, les développeurs de données, les développeurs logiciels, les chefs de produit, les architectes logiciels et les équipes opérationnelles, afin de favoriser un environnement de travail collaboratif et cohésif
- Mettre en œuvre des systèmes de contrôle de version pour les modèles d’apprentissage automatique et contribuer aux pratiques de gouvernance des modèles
- Contribuer à la mise en œuvre de pratiques robustes de gouvernance des modèles, de systèmes de contrôle de version et au respect des normes de conformité. Respecter la confidentialité des données et les considérations éthiques, afin de renforcer la confiance dans nos solutions d’IA/ML
- Appliquer les meilleures pratiques de sécurité et les normes de conformité dans tous les aspects des MLOps, en garantissant la confidentialité des données et la sécurité de la plateforme
- Identifier les opportunités d’automatisation et d’optimisation des processus, et mettre en œuvre des stratégies visant à améliorer l’ensemble du cycle de vie des MLOps
- Prendre en charge les composants critiques de la plateforme, en fournissant une orientation architecturale et en contribuant à la réussite globale de la plateforme d’IA/ML

Qualifications minimales

- Licence ou master en informatique, ou expérience pratique équivalente
- Expérience : au moins 8 ans d’expérience en développement et ingénierie logicielle, avec une solide expérience dans la mise en production de systèmes et de services
- Solide expérience en IA/ML avec une expertise en apprentissage profond, en modélisation statistique et en réseaux neuronaux
- Expérience pratique des frameworks d’IA/ML (tels que TensorFlow, PyTorch) et bonne connaissance du cycle de vie du développement de modèles d’IA/ML, de l’entraînement au déploiement
- Solides compétences en programmation dans les langages couramment utilisés en IA/ML et en développement de systèmes, tels que Python, Java ou Go
- Capacité à relever des défis techniques complexes, à analyser les solutions possibles et à mettre en œuvre les plus efficaces
- Excellentes compétences en communication pour collaborer efficacement avec des équipes pluridisciplinaires, ainsi que la capacité à travailler de manière autonome
- Compréhension approfondie des indicateurs de performance et des techniques d’optimisation de la latence, avec la capacité de diagnostiquer, d’ajuster et d’améliorer l’efficacité des systèmes de diffusion
- Un état d’esprit axé sur l’apprentissage continu pour rester au fait des dernières tendances et technologies en matière d’IA/ML, de cloud computing et d’ingénierie logicielle

Qualifications souhaitées

- Expérience de l’utilisation du calcul sur GPU pour les charges de travail d’IA/ML, y compris une expérience avec CUDA, OpenCL ou d’autres outils de programmation GPU, afin d’améliorer significativement les performances d’entraînement et d’inférence des modèles
- Expérience des technologies et des écosystèmes Big Data (Hadoop, Spark, Kafka) pour le traitement et l’analyse de grands ensembles de données dans un environnement informatique distribué
- Maîtrise des outils et des frameworks permettant de surveiller et de gérer les performances des modèles d’IA/ML en production (par exemple, MLflow, Kubeflow, TensorBoard)
- Expérience des techniques et technologies de calcul haute performance (HPC) pour l’optimisation des charges de travail computationnelles, en particulier dans le contexte de l’entraînement et de l’inférence des modèles d’IA/ML

Learn More

About Autodesk

Welcome to Autodesk! Amazing things are created every day with our software – from the greenest buildings and cleanest cars to the smartest factories and biggest hit movies. We help innovators turn their ideas into reality, transforming not only how things are made, but what can be made.

We take great pride in our culture here at Autodesk – it’s at the core of everything we do. Our culture guides the way we work and treat each other, informs how we connect with customers and partners, and defines how we show up in the world.

When you’re an Autodesker, you can do meaningful work that helps build a better world designed and made for all. Ready to shape the world and your future? Join us!

Salary transparency

Salary is one part of Autodesk’s competitive compensation package. For Canada based roles, we expect a starting base salary between $153,000 and $224,400. Offers are based on the candidate’s experience and geographic location, and may exceed this range. In addition to base salaries, our compensation package may include annual cash bonuses, commissions for sales roles, stock grants, and a comprehensive benefits package.

Belonging

We take pride in cultivating a culture of belonging where everyone can thrive. Learn more here: https://www.autodesk.com/company/global-belonging

In-Person Onboarding and Identity Verification

This role may require in-person onboarding and/or in-person ID verification.

📌 Principal Machine Learning Developer, AI/ML Platform (Toronto)
🏢 Autodesk
📍 Toronto

Reply to this offer

Impress this employer describing Your skills and abilities, fill out the form below and leave Your personal touch in the presentation letter.

Subscribe to this job alert:

Get the latest job offers by email for: principal machine learning developer, ai/ml platform (toronto) / toronto

Subscribe to this job alert:

Get the latest job offers by email for: principal machine learning developer, ai/ml platform (toronto) / toronto