Business Analytics
Curso de pregrado sobre cómo convertir datos en evidencia para decisiones de negocio, con inteligencia artificial generativa transversal a todo el semestre: R y el tidyverse, el proceso de business analytics, calidad de datos y EDA, LLMs y agentes de código, fundamentos de machine learning, clasificación y regresión con árboles, bosques aleatorios y Lasso, y clustering con k-means — cerrando con un proyecto en grupo sustentado oralmente.
Instructor: Eduard F. Martínez-González · Tatiana Mejía Herrera
Institution: Universidad ICESI — Departamento de Economía
Course code: 06327-ECO
Program: Pregrado
Term: 27 de julio – 14 de noviembre de 2026 (periodo 202620)
Credits: 3
Location: Salón 303C (Grupo 5) · Salón 305C (Grupo 7)
Time: Grupo 5: 14:00–17:00 · Grupo 7: 17:00–20:00
English version Syllabus (PDF) Programa semana a semana (PDF) Podcast del curso · El Dato con Contexto
Los materiales del curso se publican en este sitio a medida que se libera cada semana. Los documentos están construidos con Quarto y ejecutan R en el navegador vía webR: puedes correr cada ejemplo directamente en la página, sin instalar nada.
Descripción del curso
El curso introduce el proceso de business analytics: cómo convertir datos crudos en información, conocimiento y evidencia que soporte decisiones en organizaciones privadas y públicas. Se concentra en cinco tareas analíticas — resumir, visualizar, agrupar, clasificar y estimar regresiones — implementadas en R sobre datos de negocio. La inteligencia artificial generativa atraviesa todo el semestre como herramienta de trabajo: qué son los LLMs, cómo escribir buenos prompts y cómo dirigir agentes de código (Claude Code, Cursor, VS Code) de forma responsable — la IA acelera el trabajo, pero el estudiante debe entender y validar cada paso del análisis.
Cómo funciona cada semana
Cada semana de contenido publica tres materiales, en el orden en que se usan:
- Teoría — se estudia antes de clase: la versión escrita del podcast o video de la semana, con ejemplos de R ejecutables. Los episodios del podcast se publican en Spotify — El Dato con Contexto — y cada uno queda enlazado en su semana, más abajo. El quiz semanal es impreso y se responde al inicio de la clase — primero unos minutos de dudas sobre el material, luego el quiz, sin IA ni ayudas.
- Práctica guiada — la aplicación en clase, paso a paso.
- Taller — la actividad evaluable que cada estudiante desarrolla durante la sesión y entrega en Intu antes de terminar la clase.
Skills de IA del curso
Tres skills — instrucciones empaquetadas que convierten a tu asistente de IA en un ayudante que conoce este curso. Descarga el .zip y cárgalo como skill en Claude, o usa el SKILL.md que viene adentro como instrucciones en otro asistente:
curso-ba · contexto del curso monitor-r · tu monitor de R simulacro-ba · practica para el parcial
- curso-ba — el contexto: la dinámica semanal, el caso Cóndor, la evaluación y la política de IA del curso.
- monitor-r — un monitor de R que te destraba sin hacerte el taller: errores explicados, código paso a paso y diagnósticos que enseñan.
- simulacro-ba — genera simulacros con el formato exacto del parcial (un contexto y cuatro preguntas, semanas 2–6) y solo muestra la clave después de que respondes.
Resultados de aprendizaje
Al finalizar el curso, el estudiante estará en capacidad de:
- Explicar los conceptos centrales del business analytics e identificar la tarea analítica — resumir, visualizar, agrupar, clasificar, estimar — que responde una pregunta de negocio.
- Usar R para importar, explorar, limpiar, transformar y describir datos, y construir visualizaciones claras con
ggplot2. - Diagnosticar problemas de calidad de datos y llevar un análisis exploratorio desde el archivo crudo hasta un dataset listo para análisis, con decisiones documentadas.
- Entrenar y evaluar modelos de machine learning en R — CART, bosques aleatorios, Lasso y k-means — con particiones train/test y validación cruzada, comparando contra un baseline con las métricas correctas.
- Interpretar y comunicar resultados para soportar una decisión organizacional.
- Usar herramientas de IA generativa — LLMs y agentes de código — de forma crítica y responsable: prompts efectivos, salidas validadas y análisis trazable.
Cronograma
Unidad 1 — Fundamentos del curso
Semana 1 — Presentación del curso y metodología. Qué es el business analytics y qué problemas resuelve; el recorrido semana a semana; la dinámica de aprendizaje (teoría antes de clase, quiz, aplicación guiada); las reglas de evaluación, el proyecto final y la política de IA — motivada por evidencia reciente sobre cómo el uso de IA afecta la formación de habilidades.
Teoría Lectura: Shen & Tamkin (2026)
Semana 2 — Introducción a los LLMs. Qué es un modelo de lenguaje y por qué importa en economía y negocios; alcances, límites y alucinaciones; la anatomía de un buen prompt (contexto, tarea, formato de salida, restricciones); skills reutilizables para tareas recurrentes.
Teoría Podcast Práctica guiada Taller
Semana 3 — Fundamentos de R. La interfaz de RStudio y el flujo con scripts; R como calculadora; tipos de datos y valores especiales; objetos y asignación; vectores, matrices y data frames; funciones, ayuda y paquetes; el Environment y los proyectos con rutas relativas.
Teoría Video · Fundamentos de R Práctica guiada Taller
Semana 4 — Manipulación y visualización de datos. La gramática de dplyr verbo a verbo para KPIs globales y por grupo, y ggplot2 como sistema por capas (datos, estéticas, geometrías, etiquetas, temas). El producto de la semana: una tabla de KPIs y los 2–3 gráficos que la comunican.
Teoría Video · dplyr (parte 1) Video · ggplot2 (parte 2) Práctica guiada Script de la clase (.R) Taller Datos: cafeteria.csv · Taller guiado con el monitor: taller_clase.R
Unidad 2 — Proceso analítico y exploración de datos
Semana 5 — Proceso analítico y tipos de analítica. El business analytics como proceso que convierte datos en conocimiento accionable; traducir preguntas de negocio a tareas analíticas; el flujo de la pregunta a la decisión. La semana gira alrededor del Caso Cóndor: la práctica muestra, con dos ejemplos, el paso a paso de una necesidad inicial a una pregunta de negocio, y el taller — que es a la vez la Entrega 1 del proyecto final — arranca el proyecto: cada grupo de 3 elige su frente y formula la pregunta de negocio que trabajará el semestre (la entrega la carga un solo integrante).
Teoría Podcast Práctica guiada (diapositivas) Taller · Caso Cóndor Para el taller: contexto del caso (PDF) · los datos están en la sección Proyecto final
Semana 6 — EDA: fuentes, limpieza y exploración. Fuentes y calidad de datos; el checklist de diagnóstico — tipos, rangos, faltantes, duplicados, categorías inconsistentes, outliers — y el pipeline raw → clean → analysis-ready. La práctica guiada desarrolla, aplicado, un EDA del caso Cóndor alrededor de una pregunta de negocio; con el monitor y el script de la clase cada equipo carga y une las bases del caso y avanza su propio análisis exploratorio — el script que construyes es el entregable del taller.
Teoría Podcast Práctica guiada · EDA del caso Cóndor Script de la clase · caso Cóndor Taller Otro ejercicio de práctica — limpieza de datos (para hacer por tu cuenta, en casa): práctica guiada de limpieza · ferreteria_raw.csv
Semana 7 — Examen Parcial 1. Primera evaluación escrita integradora (20%), cubre las semanas 1–6. Del 7 al 12 de septiembre.
Unidad 3 — IA aplicada al análisis de datos
Semana 8 — Agentes de código: Claude Code, Cursor y VS Code. Qué es un agente de código, el bucle agéntico y el archivo de reglas. La práctica es la sesión completa: cada estudiante abre el proyecto del caso Cóndor con su agente y dirige el EDA de la pregunta de negocio de su equipo — un prompt, una tarea, una ejecución, una mirada — hasta salir con tres o cuatro resultados bien escogidos, cada uno en su propio script. Esta semana no hay taller: lo que se construye en clase es el avance que el equipo presenta en la Entrega 2 de la semana 9.
Teoría Práctica guiada · el EDA de tu proyecto con un agente Proyecto de la clase (zip, 3,3 MB) Cómo trabajar hoy: descarga el proyecto_condor.zip → descomprímelo → abre la carpeta con tu agente y sigue la práctica. Adentro vienen las cuatro tablas de Cóndor, el diccionario_datos.md y un README.md con el contexto del caso y las reglas de trabajo para el agente.
Semana 9 — Presentación Avance del Proyecto (EDA). Entrega 2 del proyecto final (5%): presentación oral del análisis exploratorio, con retroalimentación del profesor y los monitores. Del 21 al 26 de septiembre.
Unidad 4 — Fundamentos de Machine Learning
Semana 10 — Fundamentos de Machine Learning. El machine learning como generalización; el pipeline estándar — target y features, partición train/test, métricas contra un baseline; validación cruzada; sobreajuste, data leakage y métricas mal elegidas. Dos videos complementarios construyen la matriz de confusión y MAE/RMSE antes de las semanas supervisadas.
Teoría Video · Matriz de confusión Video · RMSE y MAE Práctica guiada Taller Datos: credito_taller10.csv · notas_taller10.csv · credito_evaluacion.csv · notas_evaluacion.csv
Unidad 5 — Aprendizaje supervisado
Semana 11 — Clasificación: árboles y bosques. El pipeline completo de clasificación; la matriz de confusión — por qué el accuracy engaña y el trade-off precision/recall; CART y bosques aleatorios; elegir modelo según el costo de los errores. El taller predice la fuga de clientes (churn).
Teoría Video · Árboles de clasificación Práctica guiada Taller Datos: credito_clasificacion.csv · clientes_conectatel.csv
Semana 12 — Regresión: árboles, bosques y la ruta Lasso. El pipeline de regresión con MAE/RMSE contra un baseline; regresión lineal regularizada (Lasso), árboles de regresión y ensambles (random forest / XGBoost); interpretabilidad vs. desempeño. El taller avalúa apartamentos en Cali.
Teoría Video · Árboles de regresión Práctica guiada Taller Datos: notas_regresion.csv · apartamentos_cali.csv
Unidad 6 — Aprendizaje no supervisado
Semana 13 — Clustering: fundamentos y métricas. El clustering como segmentación sin target; k-means (distancia, escalamiento, centroides); elegir k con elbow y silhouette; perfilar los segmentos para que sean accionables. La práctica segmenta canciones de Spotify; el taller, los socios de un gimnasio.
Teoría Video · k-means Práctica guiada Taller Datos: spotify_canciones.csv · socios_califit.csv
Semana 14 — Examen Parcial 2. Segunda evaluación escrita integradora (20%), cubre las semanas 8–13. Del 26 al 31 de octubre.
Semana 15 — Simulacro de la presentación final. Cada grupo presenta una versión preliminar de su sustentación y recibe retroalimentación. Del 2 al 7 de noviembre.
Semana 16 — Presentación del Proyecto Final. Sustentación oral del proyecto (Entrega 3, 20%). Equivale a un examen: la asistencia es obligatoria. Del 9 al 14 de noviembre.
Evaluación
| Componente | Peso | Uso permitido de IA |
|---|---|---|
| Quices conceptuales semanales (impresos, al inicio de la clase, cada semana de contenido) | 25% | Sin IA |
| Talleres en clase (uno por sesión, se entregan en Intu) | 10% | Colaboración con IA — cada decisión debe poder explicarse |
| Evaluación integradora 1 (semana 7) | 20% | Sin IA |
| Evaluación integradora 2 (semana 14) | 20% | Sin IA |
| Proyecto final (tres entregas) | 25% | Planificación / colaboración con IA, según la entrega |
Los quices y talleres no tienen recuperación; como mitigación, se elimina la peor nota de quices y la peor de talleres una única vez en el semestre. El uso de IA en actividades evaluables sigue la escala institucional de niveles de IAG de ICESI: cada actividad indica su nivel máximo permitido, y todo uso debe declararse, verificarse y ser trazable.
Proyecto final
Cada grupo de 3 estudiantes recibe una base de datos empresarial con múltiples variables — este semestre, el Caso Cóndor, una fintech andina (ficticia) de pagos y crédito —, formula su propia pregunta de negocio y la responde con una de las tareas analíticas del curso — clasificación, regresión o segmentación. Tres entregas: (1) la pregunta de negocio (semana 6 — requisito para las entregas posteriores), (2) la presentación oral del avance/EDA (semana 9, 5%) y (3) la sustentación final (semana 16, 20%). No hay documento escrito: la sustentación es el producto final, y el integrante que expone puede elegirse al azar.
Lineamientos del proyecto (PDF) Caso Cóndor · contexto (PDF) Datos (se unen por cliente_id): base_clientes.csv · anexo_transacciones.csv · anexo_creditos.csv · anexo_campanas.csv
Bibliografía y recursos
- Wickham, H. & Grolemund, G. (2017). R for Data Science. O’Reilly Media.
- James, G., Witten, D., Hastie, T. & Tibshirani, R. (2021). An Introduction to Statistical Learning: with Applications in R (2.ª ed.). Springer.
- Perkins, M., Roe, J. & Furze, L. (2025). Reimagining the Artificial Intelligence Assessment Scale (AIAS). JUTLP, 22(7).
Los materiales se publican progresivamente a lo largo del semestre. El podcast del curso — El Dato con Contexto — está en Spotify; los quices son impresos y se responden al inicio de cada clase, y los talleres se entregan en Intu al cierre de cada sesión.