Tous les postes
Ingénieur IA
Développe les modèles et pipelines derrière les analyses.
Stuttgart, Allemagne — hybride (2 à 3 jours/semaine au bureau)Temps plein / Étudiant salarié (Werkstudent)Ingénierie
Le moteur d'analyse — sentiment, score de relation, détection de moments clés, les insights rédigés par IA — est le cœur du produit. Tu géreras notre façon d'utiliser les LLM et les modèles classiques : les prompts, le chunking, l'évaluation, le coût et la latence. La confidentialité est une contrainte stricte : le contenu des conversations est traité de façon transitoire et jamais stocké.
Ce que tu feras
- Gérer le pipeline LLM (actuellement OpenAI + Gemini via une abstraction de fournisseur) — prompts, chunking, schémas de sortie structurée, retries et contrôle des coûts.
- Construire le système d'évaluation pour qu'un changement de prompt ou de modèle soit une amélioration mesurable, pas une impression.
- Améliorer les analyses hors LLM — modélisation du temps de réponse, segmentation des conversations, tendances d'humeur — en précision et en vitesse.
- Garder l'inférence peu coûteuse et assez rapide pour une échelle grand public ; profiler et réduire les dépenses en tokens.
- Maintenir le modèle de confidentialité : traitement transitoire, télémétrie uniquement agrégée, aucun contenu de conversation ne sort de la requête.
Ce qu'on recherche
- 3 ans ou plus à construire du logiciel en production, avec une vraie expérience du déploiement de fonctionnalités basées sur des LLM ou du ML (pas juste avoir appelé une API une fois).
- TypeScript/Node.js solide (notre stack) ou la capacité d'y arriver vite depuis un autre langage typé.
- Tu as déjà construit des pipelines prompt/réponse avec des sorties structurées et tu sais comment ils échouent.
- À l'aise avec l'évaluation : construire des jeux de données, définir des métriques, détecter des régressions.
- Anglais niveau C1 ou plus.
Un plus
- Formation NLP — embeddings, classification, sentiment.
- Expérience en optimisation coût/latence pour des applis LLM (cache, batching, routage de modèles).
- Intérêt pour l'inférence on-device / dans le navigateur.
- Allemand.
Langues
Un anglais de niveau C1 ou supérieur est requis. L'allemand est un vrai plus.
Étudiant salarié
En tant qu'étudiant salarié : ~16–20 h/semaine, en binôme avec un·e ingénieur·e senior, en charge d'une portion délimitée du pipeline (par ex. le système d'évaluation ou un module d'analyse).