Udemy
    •  
    •  
    •  
    •  
    •  
    •  
    •  
    •  
Turn what you know into an opportunity and reach millions around the world.
Learn More
Your cart is empty.
Keep shopping
Formação Completa Apache Spark: Datalakes e Iceberg 2026
Highest Rated
Rating: 4.7 out of 5(2,077 ratings)
10,092 students

Formação Completa Apache Spark: Datalakes e Iceberg 2026

Domine a mais importante ferramenta para Cientistas de Dados e Engenheiros de Dados para processamento de dados massivos
Created byFernando Amaral
Last updated 7/2026
Portuguese
Spanish [Auto],Portuguese [Auto],

What you'll learn

  • Conhecer a Arquitetura e Detalhes do Spark
  • Criação de DataFrames
  • SparkSQL: Crie tabelas e consulta utilizando SQL
  • Conecte com outras fontes de Dados, como Postgres
  • Cria Aplicações Spark
  • Desenvolva modelos preditivos Utilizado Machine Learnig e Spark ML
  • Cria aplicações próximas ao tempo real com Spark Streaming
  • Conheça Técnicas de Otimização do Spark
  • Aprenda os Fundamentos de Apache Iceberg
  • Crie um Datalake com Spark e Iceberg

Course content

15 sections91 lectures11h 4m total length
  • Apresentação3:29
  • Introdução ao Spark11:58
  • Arquitetura e Componentes9:30
  • Context e Session1:29
  • Formatos de Big Data7:51
  • Material para Download0:16

Requirements

  • Conhecimento básicos de Python

Description

Bem vindo ao melhor e mais atualizado curso de Spark!

Na era "Big Data" o Spark se tornou a principal ferramenta de processamento de dados no mundo devido a sua capacidade de processar volumes massivos de dados com alta performance, se tornando uma ferramenta essencial para Cientistas e Engenheiros de Dados. Sua arquitetura distribuída permite processar dados utilizando paralelismo e memória, persistindo dados quando necessário. Além disso o Spark é capaz de importar dados de praticamente qualquer fonte, bem como também exportar dados processados para os principais formatos e bancos de dados utilizados.

Do ponto de vista profissional, conhecer Spark é uma das habilidades mais importantes ao lado de Machine Learning e Python. E o melhor disso é o que Spark já traz tudo isso. Você pode utilizar Spark com Python, através do Pyspark, e você pode criar modelos de Machine Learning utilizando as próprias bibliotecas do Spark.

Neste curso prático, você vai começar do zero e aprender todas as principais características desta ferramenta. Entre outras coisas você vai:

  • Aprender a instalar e configurar o Spark

  • Conhecer o principal objeto de dados: DataFrames do Spark

  • Processar DataFrames através de transformações e ações

  • Consultar Dados no Spark com Sintaxe SQL

  • Criar Views e fazer Joins

  • Persistir dados em disco, criando tabelas em formatos como Parquet e ORC

  • Importar dados de outras fontes

  • Criar aplicações que você pode rodar na linha de comendo

  • Machine Learning com Spark: crie modelos e faça previsões

  • Processe dados em tempo real com Spark Structured Streaming

  • Otimize o Spark com Cache, Persistência, Particionamento e Bucketing

  • Conheça Apache Iceberg

  • Integre Iceberg com Spark

  • Construa um Data Lake

Você ainda vai encontrar material do curso para baixar: scripts, slides e dados de exemplo.


Who this course is for:

  • Cientistas de Dados, Engenheiros de Dados, Engenheiros de Machine Learning