Unidad 2 - Taller 6: tu primer EDA de la pregunta de Cóndor

Monitoría y taller evaluable · Semana 6 · 06327-ECO

Autor/a

PhD. Eduard F. Martínez-González

1 Monitoría: el punto de partida ≈ 60 min

Con el monitor (Santiago) y el script 📥 EDA Caso Condor.R, guardado en la carpeta scripts/ de tu proyecto intro_ba. Se ejecuta por bloques, de arriba abajo:

  • Bloques 1 a 4 — código completo. Carga las cuatro tablas del caso desde las URL del proyecto (no se descarga ningún archivo de datos), responde qué es una fila en cada tabla, agrega los anexos al nivel del cliente y los une a base_clientes en una base analítica con el número de filas verificado.
  • Bloque 5 — solo preguntas. Radiografía, variable objetivo y baseline, distribuciones, comparaciones por grupo, relaciones, lo que no se puede usar y el acta. El código lo escribes tú, debajo de cada pregunta, con el monitor. Cada respuesta es una salida de R con su ## HALLAZGO:, no una opinión.
  • Si la pregunta de tu equipo vive en un anexo (fraude → transacciones; mora → créditos; conversión → campañas), esa tabla es la principal y base_clientes se le pega por cliente_id. El bloque 5.2 te lo pide; el monitor te acompaña.

La monitoría es el borrador del taller. Trabaja desde el primer bloque en tu propio archivo, apellido_nombre_taller6.R: lo que avances con el monitor es lo que después completas y entregas.

2 Taller 6: qué debes hacer ≈ 40 min

Individual, sobre la pregunta de negocio de tu equipo (la del Taller 5). Los tres integrantes parten de la misma pregunta, pero cada uno escribe su propio código y produce al menos una exploración propia, distinta de la de sus compañeros: tres copias no son tres talleres. Coordinen ángulos.

  1. Encabezado: nombre, código, la pregunta del equipo, su variable objetivo (o “segmentación, sin target”) y la unidad de análisis: qué es una fila en la base de tu pregunta.
  2. La base: carga desde las URL solo las tablas que tu pregunta necesita y construye la base al grano de la pregunta —agregar primero, unir después— con una línea que confirme el número de filas. Puedes partir de lo hecho en la monitoría, escrito y corrido por ti.
  3. Tu exploración: al menos una —mejor dos o tres— ligada a la pregunta: la distribución del target, una comparación por grupos, una relación entre dos variables, un valor extremo mirado en su fila completa, una hipótesis “obvia” puesta a prueba. Tú decides qué y cómo. Al menos una salida es un gráfico o una tabla con un título que diga el mensaje y ejes etiquetados.
  4. La lectura: debajo de cada salida, ## HALLAZGO: (qué muestra, con su número) y ## POR QUÉ IMPORTA: (qué aporta para entender la pregunta), escritos para alguien de Cóndor que no sabe R. Cierra con 3 a 5 líneas: qué sabes ahora que no sabías, qué explorarías después y qué decidiste con los faltantes, los extremos y las columnas excluidas.

La regla de oro del caso: no uses como predictor nada que solo se conozca después del evento que tu pregunta quiere anticipar.

3 Qué debes entregar

  • Un archivo: apellido_nombre_taller6.R, que corre completo con Source (prueba antes de entregar: rm(list = ls()) → Source), lee los datos desde las URL del proyecto (https://eduard-martinez.github.io/teaching/ba/final_project/data/, como en el script de la monitoría; nunca desde rutas locales) y termina con la declaración de uso de IA.
  • Dónde y cuándo: en el enlace que indicará el profesor, antes de terminar la clase. La entrega solo es válida si asististe a la sesión.
  • IA, nivel 3: permitida para entender un error, recordar una sintaxis o pulir un gráfico después de intentarlo tú; no para decidir qué explorar ni para interpretar los resultados. La declaración va al final del script aunque digas que no la usaste; omitirla descuenta -0.5.
## ============================================
## DECLARACIÓN DE USO DE IA
## Herramienta y modelo usados: _______________ (o "No usé IA")
## La usé para: _______________________________
## Verifiqué por mi cuenta: ____________________
## ============================================