Développeur(euse) IA sénior, supervision d'agents IA
Télétravail d'abord, journées optionnelles au bureau de Montréal · Temps plein · Ingénierie logiciel
Des agents IA parlent maintenant à de vrais clients au téléphone. Ils donnent des prix, traitent des plaintes, répondent à des questions sur les couvertures d'assurance. La plupart des entreprises n'ont aucune idée de ce que ces agents disent réellement.
Supervisr.ai est la couche de supervision qui s'installe au-dessus de ces agents. Nous écoutons chaque conversation, signalons les enjeux critiques de conformité en temps réel pour qu'ils puissent être stoppés en plein appel, et révisons tout après l'appel pour détecter les dérives, les écarts au script et les trous dans les politiques, avant qu'un client ou un régulateur ne le fasse. La voix est notre point de départ ; le clavardage suit.
Vous bâtirez le système qui garde les autres IA honnêtes.
L'IA au cœur du produit, pas en option
Nous bâtissons notre propre produit comme nous conseillons à nos clients de bâtir le leur. Supervisr se gère en langage courant. Un responsable de la conformité décrit une règle, un comportement attendu ou un scénario de test en une phrase, et la plateforme le transforme en arrière-plan en configuration structurée, en JSON et en cas de test.
Nous utilisons des LLM, des serveurs MCP et une ingénierie rigoureuse des prompts et du contexte à l'intérieur même du produit, pas comme fonctionnalité de démonstration. Si vous en avez assez de travailler sur des « fonctionnalités IA » greffées à une application conventionnelle, c'est tout le contraire ici.
Ce que vous ferez
Vous serez responsable de livrer les fonctionnalités qui rendent les agents IA fiables en production. Concrètement :
- Concevoir la détection en temps réel qui signale, en plein appel, les manquements critiques à la conformité des agents vocaux : engagements non autorisés, énoncés interdits, faits hallucinés, problèmes de ton et de divulgation
- Bâtir la couche d'intervention : contraindre, corriger ou transférer à un humain en temps réel lorsque c'est critique, et remonter tout le reste pour révision en cours d'appel ou après l'appel
- Bâtir le pipeline d'analyse post-appel qui révise chaque conversation pour détecter les dérives, les boucles, les écarts au script et l'efficacité des règles
- Transformer des règles en langage courant en garde-fous applicables et testables, en générant automatiquement la configuration structurée et le JSON sous-jacents
- Générer des scénarios de test réalistes et adversariaux avec des LLM pour mettre les agents à l'épreuve avant et après leur mise en service
- Étendre la plateforme aux agents de clavardage avec le même modèle de supervision
- Bâtir la piste d'audit et les tableaux de bord qui permettent à un responsable de la conformité de rejouer exactement ce qu'un agent a fait, et pourquoi
- Travail de plateforme : services backend et API évolutifs, architecture événementielle, orchestration d'agents via MCP, et CI/CD pour livrer vite et avec confiance
Ce rôle est pour vous si
- Vous êtes fasciné(e) par la façon dont les LLM échouent, pas seulement par leurs réussites
- Vous préférez bâtir l'arbitre plutôt qu'un joueur de plus
- Vous pensez que le langage courant devrait être l'interface, et que la configuration structurée est le travail de la machine
- Vous voulez que l'IA dans les secteurs réglementés soit réellement tenue responsable
Notre pile technologique
Python, Java et TypeScript avec une interface Angular, le tout infonuagique natif sur Google Cloud. Nous orchestrons des flux de conformité à grande échelle et intégrons plusieurs LLM via Vertex AI, avec des serveurs MCP qui relient les pièces.
Ce que nous recherchons
Essentiel
- 5 ans et plus en développement de logiciels en production
- Solide maîtrise de Python
- Expérience infonuagique (Google Cloud Platform ou équivalent) et déploiements en conteneurs
- Expérience concrète en évaluation ou en observation du comportement des LLM en production : évaluations, garde-fous, observabilité
- Aisance avec les données en flux continu ou en temps réel
- Vous écrivez du code propre, testable et maintenable
- Excellent(e) communicateur(trice) et mentor
Atouts
- Expérience en voix, téléphonie ou reconnaissance de la parole
- MCP ou outillage d'agents
- Angular (ou React) et cadriciels frontend modernes
- Flux de conformité ou de gouvernance
- Expérience en centre de contact ou dans un secteur réglementé (assurance, services financiers)
- Infrastructure as code, Terraform, bonnes pratiques CI/CD
Pourquoi Supervisr.ai ?
- Travailler en première ligne de la supervision d'agents IA, un enjeu qui ne fait que grandir
- Petite équipe. Grand impact. Beaucoup d'autonomie
- Flexibilité et culture de télétravail
- Rémunération concurrentielle
Ce poste vous intéresse ?
Envoyez-nous votre candidature.
