Advertisements

Curso Práctico de Big Data con SQL, Spark SQL y Databricks

Advertisements
Aprende SQL para Big Data con Spark y Databricks: analiza millones de datos y crea dashboards en la nube
4.7
4.7/5
(6) Ratings
1,861 students
Created by DataBoosters Academy
Advertisements

What you'll learn

  • Ejecutar consultas SQL a escala usando Apache Spark y Databricks sobre millones de registros sin depender de Excel.
  • Comprender cómo funciona el cómputo distribuido, Spark y la arquitectura Lakehouse para analizar Big Data con eficiencia.
  • Crear tablas, vistas, transformaciones y cargas incrementales usando SQL moderno sobre Delta Lake.
  • Usar funciones avanzadas de SQL como CTEs, ventanas, rankings y comparaciones temporales para análisis profesional.
  • Optimizar consultas entendiendo shuffle, particiones, predicate pushdown y buenas prácticas de rendimiento.
  • Construir dashboards interactivos directamente en Databricks para responder preguntas reales de negocio.
This course includes:
11 total hours on-demand video
2 articles
1 downloadable resources
61 lessons
Full lifetime access
Access on mobile and TV
Certificate of completion
Advertisements

Course content

Requirements

  • No necesitas experiencia en Big Data ni en Spark.
  • Conocer SQL básico (SELECT, WHERE, GROUP BY, JOIN simples)
  • Interés por análisis de datos a mayor escala

Description

Este curso está diseñado para llevarte paso a paso desde los fundamentos del Big Data hasta el análisis avanzado con SQL moderno usando Apache Spark y Databricks, una de las plataformas más usadas en la industria.

Comenzarás configurando tu entorno en Databricks Community Edition, conociendo su interfaz, catálogos y SQL Warehouses para que desde el primer día ejecutes consultas reales sobre grandes volúmenes de datos. Muy pronto entenderás por qué Excel deja de ser suficiente cuando los datos crecen, y aprenderás conceptos clave como escalabilidad horizontal, cómputo distribuido y MapReduce de forma clara y con analogías prácticas.

Después entrarás al corazón del análisis moderno con la arquitectura Data Lakehouse y Delta Lake, donde trabajarás con datos consistentes, transacciones seguras y técnicas como Time Travel para auditar información histórica.

A lo largo del curso dominarás Spark SQL en acción: creación de tablas y vistas, agregaciones, JOINs a gran escala, subconsultas, CTEs, funciones de fecha y texto, y herramientas avanzadas como funciones de ventana para rankings, acumulados y comparaciones temporales. También aprenderás a cargar datos de forma incremental con INSERT y MERGE, tal como se hace en entornos profesionales.

No solo consultarás datos: entenderás cómo optimizar rendimiento con conceptos como predicate pushdown, particiones, shuffle y Z-Order.

Finalmente, transformarás tus análisis en visualizaciones y dashboards interactivos dentro de Databricks y cerrarás con un proyecto real de negocio donde aplicarás todo lo aprendido de principio a fin.

Este curso es tu puente práctico del SQL tradicional al mundo del Big Data en la nube.

Who this course is for:

  • Analistas de datos que ya usan SQL y quieren trabajar con grandes volúmenes de información
  • Usuarios de Excel, Power BI o BI tradicional que sienten que sus datos ya “no caben” en herramientas locales
  • Personas que quieren entrar al mundo de Big Data sin programar en lenguajes complejos
  • Profesionales de negocio que desean entender cómo se analizan datos masivos en la nube
Advertisements
AUG26-6844135
Advertisements
Advertisements
Free Online Courses with Certificates
Logo
Register New Account