Spécialiste DevOps - Ingénierie de plateforme IA
Somtech inc.
Pourquoi ce poste existe Somtech conçoit et opère des systèmes qui mènent vers la souveraineté numérique : des applications sur mesure, des données gérées et intégrées, et une plateforme interne d'agents IA autonomes — notre usine agentique — qui tournent en continu.
Cette usine agentique grandit : plus de modèles à tester, plus d'outils IA à configurer, plus de canaux de communication entre agents à maintenir.
Ce poste existe pour en faire l'opération, à temps plein et avec méthode.
Ce que tu feras
Livraison et CI/CD
Standardiser et industrialiser les pipelines de livraison (GitHub Actions) sur l'ensemble du portefeuille : build, tests, gates de qualité, déploiement.
Faire passer les tests automatisés (Playwright, Vitest) d'un filet ponctuel à une barrière fiable et rapide en intégration continue.
Réduire l'écart entre « ça marche chez moi » et « c'est en production » : environnements reproductibles, images conteneur versionnées, rollback documenté et éprouvé.
Infrastructure et exploitation
Opérer et faire évoluer l'infrastructure.
Tenir la chaîne d'environnements - cohérence des schémas, discipline des migrations PostgreSQL/Supabase, promotion contrôlée.
Introduire l'infrastructure as a code là où elle manque.
Gérer les secrets et les accès de bout en bout
Observabilité et fiabilité
Mettre en place et maintenir l'observabilité
Instrumenter les coûts d'infrastructure et d'inférence IA, et les rendre lisibles par projet et par client.
Écrire les post-mortems, et surtout porter les correctifs structurels qui en découlent.
Plateforme d'agents IA
Héberger et opérer les conteneurs d'agents autonomes internes : services longue durée, mise à jour sans interruption, isolation par organisation cliente.
Contribuer au socle d'images communes et à son cycle de vie sécuritaire.
Sécurité et conformité
Appliquer et outiller les exigences
Auditer et durcir la surface exposée :
Influence
Écrire les décisions d'architecture qui engagent la plateforme, et les défendre.
Outiller l'équipe de développement plutôt que de faire à sa place : le succès se mesure à ce que les autres livrent seuls.
Ce qu'on chercheExigé
5 ans et plus
d'expérience en DevOps, SRE ou ingénierie de plateforme, en production
Docker au quotidien.
CI/CD maîtrisé de bout en bout
PostgreSQL en exploitation : migrations, index, sauvegardes, restauration éprouvée.
Linux, réseau, TLS, DNS — le socle, pas la surface.
Aisance en scripting (Bash, Python ou TypeScript).
Avoir déjà été responsable d'une production : astreinte, incident réel, post-mortem écrit.
Français professionnel à l'écrit et à l'oral (nos clients et notre documentation sont en français).
Anglais fonctionnel en lecture est un atout (plusieurs fournisseurs de services en anglais).
Fortement apprécié
Infrastructure as code
Supabase (Auth, RLS, Edge Functions) ou expérience équivalente d'un BaaS PostgreSQL.
Observabilité moderne : OpenTelemetry, Grafana, Prometheus.
Next.js / Node.js suffisamment pour dialoguer avec l'équipe applicative et déboguer avec elle.
Contexte PME ou consultation : plusieurs clients, plusieurs contextes, arbitrages permanents.
Exposition à l'exploitation de charges IA (LLM, inférence, files d'attente).
Cette usine agentique grandit : plus de modèles à tester, plus d'outils IA à configurer, plus de canaux de communication entre agents à maintenir.
Ce poste existe pour en faire l'opération, à temps plein et avec méthode.
Ce que tu feras
Livraison et CI/CD
Standardiser et industrialiser les pipelines de livraison (GitHub Actions) sur l'ensemble du portefeuille : build, tests, gates de qualité, déploiement.
Faire passer les tests automatisés (Playwright, Vitest) d'un filet ponctuel à une barrière fiable et rapide en intégration continue.
Réduire l'écart entre « ça marche chez moi » et « c'est en production » : environnements reproductibles, images conteneur versionnées, rollback documenté et éprouvé.
Infrastructure et exploitation
Opérer et faire évoluer l'infrastructure.
Tenir la chaîne d'environnements - cohérence des schémas, discipline des migrations PostgreSQL/Supabase, promotion contrôlée.
Introduire l'infrastructure as a code là où elle manque.
Gérer les secrets et les accès de bout en bout
Observabilité et fiabilité
Mettre en place et maintenir l'observabilité
Instrumenter les coûts d'infrastructure et d'inférence IA, et les rendre lisibles par projet et par client.
Écrire les post-mortems, et surtout porter les correctifs structurels qui en découlent.
Plateforme d'agents IA
Héberger et opérer les conteneurs d'agents autonomes internes : services longue durée, mise à jour sans interruption, isolation par organisation cliente.
Contribuer au socle d'images communes et à son cycle de vie sécuritaire.
Sécurité et conformité
Appliquer et outiller les exigences
Auditer et durcir la surface exposée :
Influence
Écrire les décisions d'architecture qui engagent la plateforme, et les défendre.
Outiller l'équipe de développement plutôt que de faire à sa place : le succès se mesure à ce que les autres livrent seuls.
Ce qu'on chercheExigé
5 ans et plus
d'expérience en DevOps, SRE ou ingénierie de plateforme, en production
Docker au quotidien.
CI/CD maîtrisé de bout en bout
PostgreSQL en exploitation : migrations, index, sauvegardes, restauration éprouvée.
Linux, réseau, TLS, DNS — le socle, pas la surface.
Aisance en scripting (Bash, Python ou TypeScript).
Avoir déjà été responsable d'une production : astreinte, incident réel, post-mortem écrit.
Français professionnel à l'écrit et à l'oral (nos clients et notre documentation sont en français).
Anglais fonctionnel en lecture est un atout (plusieurs fournisseurs de services en anglais).
Fortement apprécié
Infrastructure as code
Supabase (Auth, RLS, Edge Functions) ou expérience équivalente d'un BaaS PostgreSQL.
Observabilité moderne : OpenTelemetry, Grafana, Prometheus.
Next.js / Node.js suffisamment pour dialoguer avec l'équipe applicative et déboguer avec elle.
Contexte PME ou consultation : plusieurs clients, plusieurs contextes, arbitrages permanents.
Exposition à l'exploitation de charges IA (LLM, inférence, files d'attente).
Reference: WJ-3875_13347857