Sr. Data Scientist

Hace 3 horas

Mexico City, Federal District Grupo Modelo Jornada completa

Nos enorgullece ser una empresa que ha traspasado fronteras con sus productos. Todo esto gracias a las 30,969 personas que colaboran en esta gran compañía.

Hoy forma parte de AB-InBev, la compañía cervecera más grande del mundo.


Te invitamos a participar en la vacante de:


Senior Data Scientist


Requisitos:


Escolaridad: Licenciatura en Ciencia de datos, Licenciatura en Ciencias de la computación, Licenciatura en actuaría, Licenciatura en estadística, Ingeniería en sistemas o afines. Maestría en Ciencia de datos / MBA (Deseable).

Años y área de experiencia: Más de 4 años de experiencia en posiciones como Data Scientist.

Idioma: Inglés – Avanzado (80%)

Competencias: Comunicación efectiva, pensamiento crítico, Liderazgo, gestión del tiempo y prioridades, colaboración y trabajo en equipo, adaptabilidad, Negociación e influencia, curiosidad y aprendizaje continuo.

Lugar de trabajo: Miguel Hidalgo, CDMX, México.

Horario: 8 a 5 pm


Acerca del puesto


Actividades:

  • Desarrollar productos analíticos E2E, desde el requerimiento de negocio, hasta la puesta en producción.
  • Escribir código de alto rendimiento para procesamiento de datos listos para ser usados para entrenar nuestros modelos de Machine Learning.
  • Entrenar modelos de machine learning y extraer el máximo performance en diversas aplicaciones como: Clasificación, clustering, sistemas de recomendación, forecasting, etc.
  • Integrar nuestros modelos de machine learning en la infraestructura de la compañía, asegurando su correcto funcionamiento.
  • Formar parte de sesiones técnicas para discutir el futuro de nuestros productos e implementaciones.
  • Revisión de código para asegurar la calidad de nuestra base de código (PR reviews)
  • Guiar y ayudar activamente a los miembros más junior del equipo


Requisitos minímos:

  • Programación avanzada en python, sentirse cómodo trabajando con programación orientada a objetos, patrones de diseño y principios de diseño.
  • Conocimiento en SQL para la consulta y procesamiento de datos, con sólida experiencia en el desarrollo de consultas optimizadas para el manejo masivo de datos.
  • Sentirse cómodo trabajando con módulos para el procesamiento de datos como Pandas o Polars.
  • Experiencia con frameworks para–Machine Learning como sci-kit learn, xgboost, lightgbm, pytorch, tensorflow, etc.
  • Ser capaz de reconocer e implementar patrones de diseño para mejorar nuestro código de entrenamiento de modelos, pipelines de datos, etc.
  • Experiencia en estadística aplicada, diseño de experimentos, y análisis del output de modelos de ML.
  • Experiencia en herramientas de desarrollo como git, shell scripting, CLIs, manejadores de dependencias de python, etc.
  • Sentirse cómodo explicando insights de datos, en una manera entendible para stakeholders no técnicos.
  • Habilidad para priorizar historias de usuario, tareas y delegar tareas a miembros más junior de manera adecuada.


Deseable:

  • Experiencia programando código eficiente en paquetes de procesamiento de datos distribuidos como Pyspark.
  • Experiencia con frameworks distribuidos de ML/AI como: Spark MLlib, Distributed xgboost, Pytorch, Horovod, etc.
  • Experiencia de desarrollo en Azure Databricks como plataforma: Distributed Computes, Unity Catalog, Feature Store, ML Flow, Delta Lake, etc.