Beta cerrada · PySpark + SQL

Consigue la chamba de datos practicando como en la entrevista real.

Escribe PySpark y SQL que se ejecutan de verdad, recibe validación al instante y descubre si tu solución también es eficiente: revisamos el plan físico de Spark, no solo el resultado.

  • Spark real, no simulado
  • Español e inglés
  • Modo entrevista con tiempo
ps11 · broadcast join
from pyspark.sql import functions as F

result = (
    orders.join(F.broadcast(products), "product_id")
    .groupBy("category")
    .agg(F.sum("revenue").alias("revenue"))
)

✓ 15 filas coinciden con el resultado esperado

✓ El plan físico usa BroadcastHashJoin

✓ Sin SortMergeJoin: evitaste el shuffle de la tabla grande

Lo que otras plataformas no revisan

En una entrevista de Data Engineering no basta con que el resultado salga bien. Te preguntan por qué es eficiente.

PySpark de verdad

Tu código corre en Apache Spark real, aislado y seguro. Nada de emulaciones: los errores, los tipos y los planes son los mismos que verás en el trabajo.

Validamos el plan físico

Broadcast joins, partition pruning, cache, coalesce contra repartition, salting para data skew. Revisamos cómo lo resolviste, no solo qué devolviste.

Modo entrevista

Pregunta aleatoria, cronómetro y la solución bloqueada hasta que termines. Letra grande para compartir pantalla, como en la entrevista real.

En español y en inglés

Practica en tu idioma y cambia a inglés cuando te prepares para una vacante en Estados Unidos. Cada pregunta incluye pistas y puntos para comentar con el entrevistador.

Cómo funciona

  1. 1

    Elige un reto

    PySpark o SQL, de fácil a difícil: ventanas, deduplicación, sesionización, data skew, SCD tipo 2 y más.

  2. 2

    Escribe y ejecuta

    Editor a la derecha, enunciado y datos a la izquierda. Ejecuta las veces que quieras y pide pistas progresivas.

  3. 3

    Valida y aprende

    Ves exactamente qué fila no coincide y qué parte del plan falló, y comparas con la solución de referencia.

Únete a la beta cerrada

Estamos abriendo lugares poco a poco. Déjanos tu correo y te enviamos tu enlace de acceso cuando haya lugar.

Aviso de privacidad simplificado: DataChamba es responsable del tratamiento de tu correo, que usamos solo para invitarte a la beta y enviarte novedades. Puedes pedir que lo borremos escribiendo a contacto@datachamba.com.

Preguntas frecuentes

¿Necesito instalar algo?

No. Todo corre en el navegador; Spark y SQL se ejecutan en nuestros servidores, en un entorno aislado.

¿Para qué roles sirve?

Data Engineer, Analytics Engineer y Data Analyst con SQL avanzado. Los retos van desde lo básico hasta optimización de Spark.

¿Qué dialecto de SQL usan?

Lo anunciaremos al abrir la beta. Elegiremos uno estándar y cercano a lo que te piden en las entrevistas.

¿Cuánto cuesta?

La beta cerrada es gratuita. Después habrá un plan gratuito y uno de pago en pesos mexicanos y en dólares.

¿Qué hacen con mi código y mis datos?

Tu código solo se usa para ejecutarlo y validarlo. No vendemos tus datos. Publicaremos el aviso de privacidad antes de abrir los registros.