Retour aux offres
Inferent · Intelligence Artificielle / Recherche et Développement
Ingénieur(e) en entraînement et inférence de modèles LLM (Python)
Nous recherchons un(e) ingénieur(e) spécialisé(e) dans l’entraînement, l’évaluation et la mise en production de grands modèles de langage (LLM), avec une expérience en Python, en apprentissage automatique et en systèmes d’inférence efficaces.
México Temps plein · Intermédiaire
À propos du poste
Chez Inferent, nous construisons des infrastructures et des produits fondés sur l’intelligence artificielle appliquée.
Nous recherchons un profil technique spécialisé dans les grands modèles de langage (LLM), capable de travailler de l’expérimentation et de la recherche appliquée jusqu’au déploiement de systèmes intelligents en production.
Responsabilités :
- Concevoir et exécuter des processus d’entraînement et de fine-tuning de modèles LLM.
- Créer des pipelines de préparation, de nettoyage et d’évaluation des jeux de données.
- Mettre en œuvre des systèmes d’inférence efficaces et évolutifs.
- Optimiser la mémoire, la latence et les performances des modèles.
- Expérimenter avec des architectures modernes d’intelligence artificielle.
- Intégrer des modèles propriétaires et externes dans les produits Inferent.
- Créer des outils internes d’évaluation et de benchmarking.
- Collaborer avec les équipes d’ingénierie et de produit.
Responsabilités
- Concevoir et exécuter des processus d’entraînement et de fine-tuning de modèles LLM.
- Créer des pipelines de préparation, de nettoyage et d’évaluation des jeux de données.
- Mettre en œuvre des systèmes d’inférence efficaces et évolutifs.
- Optimiser la mémoire, la latence et les performances des modèles.
- Expérimenter avec des architectures modernes d’intelligence artificielle.
- Intégrer des modèles propriétaires et externes dans les produits Inferent.
- Créer des outils internes d’évaluation et de benchmarking.
- Collaborer avec les équipes d’ingénierie et de produit.
Exigences
- Python avancé.
- PyTorch.
- TensorFlow.
- Transformers.
- Architecture Transformer.
- Linux.
- Git.
- Apprentissage automatique.
Atouts
- • Hugging Face.
- • Llama.
- • Mistral.
- • Qwen.
- • Fine-tuning.
- • LoRA / QLoRA.
- • RAG.
- • Bases de données vectorielles
- • CUDA.
- • Docker.
- • Kubernetes.
- • C++.
- • Rust.
- • Go.