Description
We are seeking an experienced SDET Lead to take ownership of test engineering for our AI agents and AI platform: the automation frameworks, the evaluation suites for LLM-based agents, and the quality gates in our pipelines.
This is a hands-on role.
You will write and review test code every week and set the testing standards the engineering teams follow.
You will bridge the gap between internal product management, engineering teams, and the AI engineers who build our agents—ensuring that our software releases meet the highest standards of reliability, performance, and security.
Nous recherchons un(e) SDET Lead expérimenté(e) pour prendre en charge l’ingénierie des tests de nos agents d’IA et de notre plateforme d’IA, notamment les frameworks d’automatisation, les suites d’évaluation pour les agents basés sur les LLM et les contrôles qualité intégrés à nos pipelines.
Il s’agit d’un rôle très pratique et technique.
Vous développerez et réviserez du code de test chaque semaine et définirez les normes de qualité et de test que les équipes d’ingénierie devront appliquer.
Vous serez le lien entre la gestion des produits internes, les équipes d’ingénierie et les ingénieurs spécialisés en IA qui développent nos agents.
Votre rôle sera de vous assurer que nos versions logicielles respectent les normes les plus élevées en matière de fiabilité, de performance et de sécurité.
Key Responsibilities / Responsabilités principales
Test Engineering & Automation / Ingénierie des tests et automatisation
Design, build and maintain the test automation frameworks for our AI agents, the AI platform and its APIs.Concevoir, développer et maintenir les frameworks d’automatisation des tests pour nos agents d’IA, notre plateforme d’IA et ses API.Build evaluation suites for LLM-based agents: curated test datasets, regression checks on prompts and tool calls, and LLM-as-judge scoring, run on every change to a model, prompt or agent.Créer des suites d’évaluation pour les agents basés sur les LLM : jeux de données de test soigneusement sélectionnés, tests de régression des prompts et des appels aux outils, ainsi que des évaluations utilisant un LLM comme juge, exécutées à chaque modification d’un modèle, d’un prompt ou d’un agent.Test what is specific to agents: non-deterministic output, multi-step workflows, tool and API calls, guardrails, prompt injection and data leakage.Tester les aspects spécifiques aux agents : sorties non déterministes, workflows en plusieurs étapes, appels aux outils et aux API, mécanismes de protection (guardrails), injections de prompts et fuites de données.Establish automated quality gates within our CI/CD pipelines so that a change to code, a prompt or a model can't ship without passing its tests and evals.Mettre en place des contrôles qualité automatisés (quality gates) dans nos pipelines CI/CD afin qu’aucune modification du code, d’un prompt ou d’un modèle ne puisse être mise en production sans avoir réussi les tests et les évaluations requis.Drive test planning, execution strategy, risk analysis, and test data management strategies.Piloter la planification des tests, la stratégie d’exécution, l’analyse des risques ainsi que les stratégies de gestion des données de test.Lead root-cause analysis (RCA) sessions for high-severity production defects and institute preventative measures.Diriger les séances d’analyse des causes profondes (RCA — Root Cause Analysis) pour les anomalies de production critiques et mettre en place des mesures préventives.Review test code and application code, and coach engineers on testability and automation.Effectuer des revues du code de test et du code applicatif, et accompagner les ingénieurs sur les pratiques favorisant la testabilité et l’automatisation.Cross-Functional Collaboration / Collaboration interfonctionnelle
Partner closely with Product Managers, Software Engineering Leads and AI engineers to integrate testing early in the AiDLC.Collaborer étroitement avec les Product Managers, les responsables de l’ingénierie logicielle et les ingénieurs IA afin d’intégrer les tests dès les premières étapes de l’AiDLC (AI Development Life Cycle).Serve as the primary escalation point for quality-related issues across all release streams.Être le principal point d’escalade pour les problèmes liés à la qualité sur l’ensemble des flux de mise en production.Report quality health dashboards and operational status directly to senior technology leadership.Présenter directement aux responsables technologiques seniors les tableaux de bord sur la santé de la qualité ainsi que l’état opérationnel des produits et des versions.
Core Competencies / Compétences clés
Test Automation Architecture / Architecture de l’automatisation des testsQA Strategy & Test Governance / Stratégie QA et gouvernance des testsAI Agent Testing / Tests des agents IADistributed Team Leadership / Leadership d’équipes distribuéesMetrics & Quality Analytics / Indicateurs et analyse de la qualitéBilingual Communication / Communication bilingueProfessional proficiency in both French and English is standard for Montreal-based leadership positions to align with local business operations and Quebec language laws (Bill 96).Maîtrise professionnelle du français et de l’anglais, à l’oral comme à l’écrit, généralement requise pour les postes de leadership basés à Montréal afin de répondre aux besoins des activités locales et aux exigences linguistiques du Québec (projet de loi 96).
Tool Stack / Stack Technologique:
Test & Defect Management / Gestion des tests et des anomalies: Jira, Xray, Zephyr, TestRailTest Automation Frameworks / Frameworks d’automatisation des testss: Cypress, Playwright, Selenium, Appium, Postman, RestAssuredCI/CD & Pipeline Integration / Intégration CI/CD et pipelinesn: Jenkins, GitHub Actions, GitLab CI, Azure DevOpsPerformance & Load Testing / Tests de performance et de charge: JMeter, k6, BlazeMeterCollaboration / Collaboration: Confluence, Slack, MS Teams, Miro, NotionAnalytics & Reporting / Analyse et reporting: Power BI, Tableau, Jira DashboardsAI Tooling / Outils d'intelligence artificielle: Claude, Codex...AI Evaluation & Observability / Évaluation et observabilité de l'IA Langfuse, promptfoo, DeepEval, RagasLanguages / Langages: TypeScript, Python
Qualifications & Requirements / Qualifications et exigences
Experience / Expérience
7+ years of experience in software testing or software development, including 5+ years of hands-on experience writing test automation and 2+ years in a technical leadership role.Plus de 7 ans d’expérience en tests logiciels ou en développement logiciel, dont au moins 5 ans d’expérience pratique en automatisation des tests et 2 ans ou plus dans un rôle de leadership technique.Programming / Programmation
Strong programming skills in TypeScript or Python.
Ability to write production-quality test automation code and conduct code reviews for other engineers.Solides compétences en programmation avec TypeScript ou Python.
Capacité à développer du code d’automatisation de tests de qualité production et à effectuer des revues de code pour d’autres ingénieurs.Technical Depth / Expertise technique
Expert, hands-on experience with test automation frameworks, preferably Playwright, or alternatively Cypress or Selenium, as well as API testing using tools such as Postman and REST APIs.Expertise pratique et approfondie des frameworks d’automatisation des tests, idéalement Playwright, ou Cypress ou Selenium, ainsi que des tests d’API à l’aide d’outils tels que Postman et des API REST.AI Testing / Tests d’IA
Experience testing LLM-based features or AI agents, including building evaluation suites, prompt regression tests, and red-team testing or security checks for AI systems.Expérience dans les tests de fonctionnalités basées sur les LLM ou d’agents IA, notamment la création de suites d’évaluation, de tests de régression des prompts et de tests de type red team ou de contrôles de sécurité pour les systèmes d’IA.Process Mastery / Maîtrise des processus
Deep knowledge of release management and continuous delivery (CI/CD) pipelines, with experience using platforms such as Jenkins, GitHub Actions, or Azure DevOps.Connaissance approfondie de la gestion des mises en production et des pipelines de livraison continue (CI/CD), avec une expérience de plateformes telles que Jenkins, GitHub Actions ou Azure DevOps.Language / Langues
Professional fluency in both French and English, spoken and written, required for local collaboration, communication, and compliance in Montreal.Maîtrise professionnelle du français et de l’anglais, à l’oral comme à l’écrit, requise pour assurer la collaboration locale, la communication et la conformité à Montréal.Education / Formation
Bachelor’s degree in Computer Science, Software Engineering, or a related field, or equivalent practical experience.Diplôme de baccalauréat en informatique, en génie logiciel, dans un domaine connexe, ou expérience pratique équivalente.