Senior Data Engineer
Kavak · Mexico City
Skills in this posting
Benefits
The posting
Sobre Kavak
Como el primer unicornio mexicano, con presencia en varios países y un modelo de negocio AI‑first, en Kavak estamos redefiniendo el mercado de autos usados y la experiencia de millones de usuarios en LatAm.
Hemos sido una de las compañías mejor valoradas de la región y recientemente cerramos una ronda de inversión de USD $300M liderada por Andreessen Horowitz, una de las mayores inversiones que han hecho en Latinoamérica.
Con este crecimiento, nos emociona sumar a más personas que nos ayuden a construir el próximo capítulo de nuestro producto, llevando al siguiente nivel nuestros esfuerzos de construir con inteligencia artificial.
Estamos construyendo con IA en nuestra operación core; desde comercio conversacional, hasta marketing generativo, hasta sistemas que extraen insights de millones de interacciones. Somos un equipo que imagina lo imposible, lo construye y vive la disrupción, la proactividad y la ambición en un contexto de hipercrecimiento.
Sobre el Rol
El equipo de Planning & Data de Kavak construye y opera la capa de datos que alimenta a Growth y Marketing: consolidación de inversión publicitaria multi-plataforma, atribución de campañas, cohortes de clientes, Value Based Bidding (VBB), métricas de retail.
Buscamos un/a Senior Data Engineer con visión de arquitectura de datos y experiencia operando pipelines de alto volumen. Esperamos que entiendas el problema de negocio, diseñes la solución técnica más adecuada y la lleves a producción de punta a punta — desde la ingesta (APIs, CDCs, Glue jobs) hasta las capas de transformación y serving.
Trabajarás de cerca con equipos de Growth y Marketing, y en colaboración con otros equipos de Kavak o proveedores externos cuando el proyecto lo requiera. Valoramos fuerte capacidad de trabajo en equipo, comunicación clara y orientación al negocio: entender la problemática antes de proponer una solución técnica.
En Kavak la IA es parte central del día a día: el equipo trabaja apoyado en herramientas como Cursor, Claude, Codex y LLMs similares para acelerar desarrollo, análisis y resolución de problemas. Dentro de Growth operan varios agentes de IA; es necesario entender cómo funcionan y qué resuelven.
Responsabilidades
Entender el negocio y traducirlo en soluciones de datos — trabajar con Growth, Marketing y Media para definir qué construir, no solo cómo implementarlo.
Diseñar e implementar pipelines end-to-end: ingesta desde APIs de plataformas de ads, CDCs de cuentas de plataforma, jobs de AWS Glue (Python/Spark) y transformaciones en capas Landing → Refined → Serving.
Construir y evolucionar productos de datos, entre ellos
Consolidación de plataformas de Marketing
Atribución de campañas (L1/L2, target date, click date)
Customer cohorts y señales de comportamiento (Amplitude, leads, funnel)
Value Based Bidding (VBB) — valor por segmento para optimización de adquisición
Growth velocity y estado de usuarios (qualified leads, changelog SCD2)
Eventos de CRM
Operar y escalar pipelines en producción con Apache Airflow: monitoreo, backfills, diagnóstico de huecos de datos y runbooks.
Migrar y mantener el stack legacy (Redshift, Glue) hacia el data mesh de Martech en Databricks, proponiendo la arquitectura más escalable en cada caso.
Colaborar con equipos multidisciplinarios — Growth, Marketing, Data Science y equipos externos (internos o consultoras) para alinear soluciones técnicas con objetivos de negocio.
Asegurar calidad y gobernanza: contratos de datos, deduplicación CDC, PII, linaje y metadata de ownership.
Participar activamente en CI/CD: GitLab CI, pre-commit, code review y despliegues controlados.
Requerimientos
5+ años en Data Engineering con ownership de pipelines y modelos en producción.
Fuerte conocimiento de arquitectura de datos: capacidad de evaluar alternativas y proponer soluciones escalables, no solo consumir lo ya implementado.
Experiencia con arquitecturas de 3 capas (Landing → Refined → Serving) y, preferentemente, con patrones de data mesh en Databricks.
Dominio avanzado de SQL y sólida experiencia en Python para ETLs, integraciones, scripts de ingesta y automatizaciones.
Experiencia con grandes volúmenes de datos (billones de filas, estrategias incrementales, backfills, optimización de performance).
Experiencia en producción con dbt y al menos una plataforma lakehouse (Databricks / Spark / Delta Lake).
Experiencia con almacenamiento y consulta columnar: Delta Lake (formato Parquet en lakehouse) y/o Redshift (legacy).
Experiencia sólida en AWS para datos: S3, IAM, orquestación con Airflow y AWS Glue (jobs Python/Spark, ingesta y transformación).
Experiencia en el ciclo completo de CI/CD en equipos de datos.
Fuerte habilidad para trabajar en equipo y colaborar con perfiles de negocio y técnicos; capacidad de entender la problemática con foco en el negocio antes de implementar.
Español fluido; inglés técnico para documentación y herramientas.
La posición es remota con disponibilidad a v isitas puntales a la oficina. Buscamos disponibilidad para encuentros presenciales cuando ayuden a acelerar decisiones: workshops, compartir eventos de Growth, cierres de Q, recibidas de gente que viene de otras regiones (BR/MX).
Deseables
Experiencia en MarTech / AdTech: ad spend consolidation, atribución, cohorts, LTV, VBB/tROAS.
Familiaridad con Amplitude, Insider, Meta Ads, Google Ads, TikTok Ads.
Conocimiento en desarrollo de APIs (FastAPI o frameworks similares).
Experiencia usando IDEs y asistentes con IA (Cursor, Claude Code, Codex, Codex o similares) como parte del flujo de trabajo diario.
Comprensión de agentes de IA en producción: cómo operan, qué problemas resuelven y cómo integrarse con pipelines o productos de datos.
Experiencia con modelos de ML en producción (feature engineering, datasets para entrenamiento, mantenimiento de pipelines ML).
Migración Redshift → Databricks.
Colaboración con Data Science en experimentación (A/B tests, incrementality).
Kavak Talent Mindsets
Deliver Impact: You prioritize what generates measurable results and raise the bar using technology and data. You have a consistent track record of delivering relevant and measurable results.
Engage Fast: You act on problems and opportunities. You decide on time, advance in short cycles, and adjust when necessary without compromising standards.
Engage with Purpose: You act with extreme ownership, taking total responsibility for results that impact your work and aligning decisions with Kavak's vision and purpose.
Play to Win Together: You prioritize collective results over individual success
Beneficios en Argentina
Modalidad de contratación: Relación de dependencia con salario en USD.
Prepaga: Osde 310 (grupo familiar).
Salario en blanco.
Incluye 13 sueldos anuales (aguinaldo).
La escala de Ganancias se ajusta periódicamente.
Vacaciones: 20 días hábiles (a gozar según fecha de ingreso).
Día de cumpleaños libre.
Descuento en la compra de un auto en Kavak.com .
Descuento en Wellhub (ex Gympass).
Dos días libres por mudanza.
Licencia extendida por nacimiento y adopción según política vigente.
Descuento en Coderhouse y Digital House.
Descuento en Posgrados, Maestrías y Educación Ejecutiva en algunas de las universidades del país.
The PivotHop read
- What a data engineer actually earnsmedian, seniority, by country
- Where data engineers move nextevery measured route out
- Data Architect → Data Engineer47% readiness
- Data Analyst → Data Engineer30% readiness
- All open data engineer rolesthe full board
Where these skills also reach
- 101 open data architect roles84% readiness from data engineer
- 616 open data analyst roles62% readiness from data engineer
- 64 open database administrator roles62% readiness from data engineer
- 1246 open solutions architect roles54% readiness from data engineer
More data engineer roles
Data Engineer (H/F) at AltenLille, FRTodayUnlock
Data Engineer / Big Data (H/F) – Expert GCP, Kafka, Spark, Scala, Cassandra at AltenBoulogne-Billancourt, FRTodayUnlock- Data Platform Engineer (f/m/d) for the European AI Factory HammerHAI at LrzGarching bei München1d agoApply
Data Engineer at ASP GroupBerlin1d agoApply
Senior Data Engineer - Bilingual at ConcentrixMexico · Remote1d agoApply
Backfilled listing, refreshed with the nightly scrape; the employer has not claimed it yet. Are you the employer? Claim this listing and it can be featured to the candidates whose skills already reach it, first month free.