Udemy
    •  
    •  
    •  
    •  
    •  
    •  
    •  
    •  
Turn what you know into an opportunity and reach millions around the world.
Learn More
Your cart is empty.
Keep shopping
Big Data - Apache Spark com PySpark para Iniciantes.
Rating: 4.2 out of 5(175 ratings)
718 students

Big Data - Apache Spark com PySpark para Iniciantes.

Aprenda a utilizar o Apache Spark para processar grandes volumes de dados.
Last updated 6/2022
Portuguese
Portuguese [Auto],

What you'll learn

  • Você terá um conhecimento sólido da estrutura do Apache Spark e será capaz de escrever e otimizar aplicativos PySpark.
  • Aprenda os principais conceitos, como RDDs, DataFrames, transformações e muito mais
  • Compreenda a arquitetura do Spark e o fluxo de execução de um aplicativo Spark

Course content

4 sections43 lectures5h 41m total length
  • Introdução9:20

    Nesta aula, irei da uma introdução sobre o Apache Spark e explico como funciona a distribuição de tarefas em um cluster

  • Repositório com os fontes0:03

    Fontes com o conteúdo utilizado nas aulas

  • Ecossistema do Apache Spark7:47

    Nesta aula, iremos falar um pouco sobre o ecossistema do Apache Spark

  • Baixando os binários e configurando no Windows10:45

    Nesta aula, iremos fazer os download dos arquivos binários no site do Apache Spark

  • Configuração dos binários no linux19:47

    Nesta aula, iremos utilizar o docker para mostrar a configuração do Apache Spark em um ambiente Linux

  • Lista de download0:20

    Aqui estou listando o que você precisará baixar para configurar sua máquina, caso tenha dificuldades de acompanhar no vídeo.

  • Acessando Spark Shell, Spark UI conhecendo transformações e ações.20:51

    Nesta aula, iremos conhecer a Spark UI e também os conceitos de transformação e ação

  • Baixando o PyCharm e Instalando o Pyspark com o PIP7:34

    Nesta aula, iremos fazer o download do PyCharm e aprender uma forma rápida de utilizar o PySpark

  • Criação de conta no Databricks Community3:21

    Nesta aula, iremos fazer o cadastro no Databricks Community

Requirements

  • Saber o Básico de Python

Description

Apache Spark é uma estrutura flexível que permite o processamento de dados em batch e em stremming.

Seu mecanismo unificado o tornou bastante popular para casos de uso de big data. Este curso o ajudará a começar a usar o Apache Spark 3.0 e a escrever aplicativos de big data para uma variedade de casos de uso. Aqui vamos ensinar como configurar o Spark em sua máquina local. À medida que avançamos, você será apresentado a conjuntos de dados distribuídos resilientes (RDDs) e APIs de DataFrame e suas transformações e açõe. Em seguida, passamos para o ciclo de vida de um aplicativo Spark . Você também conhecerá os módulos integrados do Spark para SQL e execução de notebooks no Databricks.

Ao final deste curso, você terá um conhecimento fundamental sólido da estrutura do Apache Spark e será capaz de escrever e otimizar aplicativos Spark.


- Aprenda os principais conceitos, como RDDs, DataFrames, transformações e muito mais

- Configure um ambiente de desenvolvimento Spark

- Escolha as APIs certas para seus aplicativos

- Compreenda a arquitetura do Spark e o fluxo de execução de um aplicativo Spark

- Aprenda a executar seus aplicativos no Databricks Community

- Entenda como utilizar o Spark SQL

- Aplique na prática as Window Functions

Who this course is for:

  • Engenheiros de Dados
  • Cientistas de Dados
  • Analistas de Dados
  • Desenvolvedores no geral que estão querendo fazer a transição para área de dados
  • Estudantes