Contacta con nosotros

Temario del curso

Introducción

  • Visión general de las características y arquitectura de Spark y Hadoop
  • Comprensión del big data
  • Fundamentos de la programación en Python

Primeros Pasos

  • Configuración de Python, Spark y Hadoop
  • Comprensión de las estructuras de datos en Python
  • Comprensión de la API de PySpark
  • Comprensión de HDFS y MapReduce

Integración de Spark y Hadoop con Python

  • Implementación de RDDs de Spark en Python
  • Procesamiento de datos utilizando MapReduce
  • Creación de conjuntos de datos distribuidos en HDFS

Aprendizaje Automático con Spark MLlib

Procesamiento de Big Data con Spark Streaming

Trabajo con Sistemas de Recomendación

Trabajo con Kafka, Sqoop y Flume

Apache Mahout con Spark y Hadoop

Solución de Problemas

Resumen y Próximos Pasos

Requerimientos

  • Experiencia con Spark y Hadoop
  • Experiencia en programación con Python

Público Objetivo

  • Científicos de datos
  • Desarrolladores
 21 Horas

Número de participantes


Precio por participante

Reseñas (3)

Próximos cursos

Categorías Relacionadas