Inferent Logo
Inferent
Volver a vacantes

Inferent · Inteligencia Artificial / Research & Development

Ingeniero(a) de Entrenamiento e Inferencia de Modelos LLM (Python)

Buscamos un(a) Ingeniero(a) especializado(a) en entrenamiento, evaluación e implementación de modelos de lenguaje de gran escala (LLM), con experiencia en Python, machine learning y sistemas de inferencia eficientes.

México Tiempo completo · Intermedio

Acerca del rol

En Inferent estamos construyendo infraestructura y productos basados en inteligencia artificial aplicada. Buscamos un perfil técnico especializado en modelos de lenguaje de gran escala (LLM), capaz de trabajar desde la experimentación e investigación aplicada hasta el despliegue de sistemas inteligentes en producción. Responsabilidades: - Diseñar y ejecutar procesos de entrenamiento y fine-tuning de modelos LLM. - Crear pipelines de preparación, limpieza y evaluación de datasets. - Implementar sistemas de inferencia eficientes y escalables. - Optimizar memoria, latencia y rendimiento de modelos. - Experimentar con arquitecturas modernas de inteligencia artificial. - Integrar modelos propios y externos dentro de productos Inferent. - Crear herramientas internas de evaluación y benchmarking. - Colaborar con equipos de ingeniería y producto.

Responsabilidades

  • Diseñar y ejecutar procesos de entrenamiento y fine-tuning de modelos LLM.
  • Crear pipelines de preparación, limpieza y evaluación de datasets.
  • Implementar sistemas de inferencia eficientes y escalables.
  • Optimizar memoria, latencia y rendimiento de modelos.
  • Experimentar con arquitecturas modernas de inteligencia artificial.
  • Integrar modelos propios y externos dentro de productos Inferent.
  • Crear herramientas internas de evaluación y benchmarking.
  • Colaborar con equipos de ingeniería y producto.

Requisitos

  • Python avanzado.
  • PyTorch.
  • TensorFlow.
  • Transformers.
  • Arquitectura Transformer.
  • Linux.
  • Git.
  • Machine Learning.

Deseables

  • Hugging Face.
  • Llama.
  • Mistral.
  • Qwen.
  • Fine-tuning.
  • LoRA / QLoRA.
  • RAG.
  • Vector databases.
  • CUDA.
  • Docker.
  • Kubernetes.
  • C++.
  • Rust.
  • Go.