Posición abierta · 2026
Tech  /  Data  /  Full-time

Data Engineer.

Buscamos a la persona que haga que los datos de Idilio existan, estén limpios y estén disponibles: cada evento, cada transacción, cada fuente externa, fluyendo de forma confiable hacia el warehouse. Vas a ser dueña o dueño de la infraestructura de datos de una plataforma de micronovelas en español — y de los pipelines agénticos que se construyen encima de ella.

Ubicación
Ciudad de México
Esquema híbrido
Experiencia
2 – 5 años
Reporta a
CTO
Equipo
Pequeño, técnico, sin proxies
01 — Sobre nosotros

Una plataforma de micronovelas en español, basada en Colombia y México.

Monetizamos con un modelo de monedas (microtransacciones), ads y suscripciones. Somos un equipo pequeño y técnico.

Estamos en una etapa donde cada decisión basada en datos — qué shows producir, dónde gastar en adquisición, qué experimentos correr — tiene impacto directo en la economía del negocio. Nos movemos rápido, y en el centro de todo está la tecnología.

~1M
Descargas en 27 países, creciendo cada mes.
336M
Filas en analytics_events. El costo de infra es una métrica de producto.
3
Líneas de ingreso simultáneas: monedas, ads, suscripciones.
02 — El rol

Vas a ser dueña o dueño de la infraestructura de datos de Idilio.

En la práctica esto significa tres cosas, en este orden: que los datos lleguen (ingesta desde la app, el backend, ads, pagos y atribución), que sean confiables (limpieza, calidad, esquemas, monitoreo) y que estén disponibles para cualquier persona o agente que los necesite, sin fricción.

Encima de esa base vas a construir pipelines agénticos: flujos donde agentes de IA consumen el warehouse, ejecutan análisis y toman o proponen acciones. Y sí, también harás analítica — pero como consecuencia de tener los datos bien, no como el trabajo principal.

La fundación existe — no empiezas desde cero — pero necesitamos un owner que la haga robusta, la extienda y la convierta en un producto interno.

AWSRedshiftS3DMSEC2SQSdbtSupabaseNext.jsFlaskReact NativeWindsor AIRevenueCatSingularPythonClaude APIMCP
03 — Responsabilidades

Lo que vas a hacer.

Ingesta: que todos los datos lleguen

Supabase → DMS → Redshift, S3/Firehose/Spectrum para eventos de alto volumen, más conectores a RevenueCat, Singular, Google Ad Manager, AdMob y Windsor AI. Si una fuente existe y no está en el warehouse, es tu problema a resolver.

Limpieza y calidad de datos

Esquemas versionados, deduplicación, validaciones en dbt, tests de frescura y volumen, alertas cuando algo se rompe. Los números tienen que ser correctos antes de que alguien los mire.

Disponibilidad: el warehouse como producto interno

Marts documentados, una sola definición por métrica (ROAS, LTV, retención por cohorte, contribution margin), acceso simple para producto, marketing, finanzas y agentes. Los dashboards deberían cargar sin delay.

Pipelines agénticos

Diseñar y operar flujos donde agentes de IA (LLMs con herramientas, MCP, orquestadores) consumen el warehouse para investigar anomalías, generar reportes, clasificar contenido o proponer acciones. Tú defines las interfaces, los guardrails y la observabilidad.

Orquestación y confiabilidad

Scheduling, reintentos, backfills, idempotencia. Un pipeline que falla en silencio no existe. Vas a heredar el sistema funcionando y hacerlo más robusto.

Optimización de Redshift y costo

Sort keys, materialized views, Spectrum para tablas pesadas. analytics_events ya tiene 336M filas. El costo de infra es métrica de producto.

Instrumentación con producto y marketing

Qué eventos almacenamos, con qué esquema, cómo atribuir installs (sobre todo post-iOS 14) y cómo medir la salud de la economía de monedas.

Analítica (parte del rol, no el centro)

Cuando el revenue cae 25% week-over-week o un A/B da resultados raros, ayudas a encontrar el porqué y a leer los experimentos. También construyes la infra de experimentación que lo hace fácil para los demás.

04 — Quién eres

Buscamos una mezcla específica.

No esperamos un unicornio. Esperamos a alguien con SQL y Python afilados, obsesión por la confiabilidad de los datos, curiosidad genuina por los agentes de IA, y la disposición para trabajar muchas veces con specs incompletos.

// Indispensable

  • Experiencia construyendo y operando pipelines de datos en producción: ingesta, transformación, orquestación, backfills.
  • SQL fuerte: CTEs naturales, window functions, debug de queries lentas o con resultados raros.
  • Python sólido para pipelines, integraciones con APIs y scripting.
  • Warehouse moderno (Redshift, Snowflake, BigQuery) y herramienta de transformación (dbt, Dataform o equivalente).
  • Calidad de datos como hábito: tests, esquemas, monitoreo, alertas.
  • Modelado dimensional, ETL/ELT, criterio para decidir dónde vive cada cosa.
  • Auto-dirección. Vas a trabajar muchas veces con specs incompletos.

// Fuertemente preferido

  • Stack AWS: Redshift, S3, DMS, Firehose, IAM, SQS.
  • Haber construido flujos con LLMs y agentes: tool use, MCP, orquestadores (LangGraph, Claude Agent SDK o similar), evaluación y guardrails.
  • Analítica basada en eventos (mobile o web) e integración de fuentes de ads, pagos y atribución.
  • Sentido de negocio: te importa el por qué detrás de los números, no solo el qué.
  • Git y code review como práctica cotidiana.

// Nice to have

  • Streaming, mobile gaming, ad tech, o productos con microtransacciones.
  • Modelado de atribución, análisis de retención, economía de subscriptions o marketplaces.
  • pandas/sklearn para análisis exploratorios; herramientas de BI (Metabase, Looker) o dashboards custom.
05 — Compensación y logística

Cómo se ve el día a día y lo que ofrecemos.

Base + equity

Base competitiva calibrada a experiencia y ubicación, más equity.

Híbrido CDMX

3–5 días en oficina con cierta flexibilidad en horarios y fechas.

Equipo binacional

Colaboración en persona en México y remota con el equipo en Colombia.

Viajes

Posibles viajes a Colombia para sincronizar con el equipo.

06 — Cómo aplicar

Aplica aquí.

Leemos cada aplicación con cuidado. Si eres un fit, sabes de nosotros en una semana.

¿No ves el formulario? Ábrelo en una pestaña nueva.

Una semana de respuesta. Sin filtros automatizados. Sin tareas de 40 horas.