Udemy
    •  
    •  
    •  
    •  
    •  
    •  
    •  
    •  
Turn what you know into an opportunity and reach millions around the world.
Learn More
Your cart is empty.
Keep shopping
Manipulação de Dados em Grande Escala com PySpark
Rating: 4.7 out of 5(35 ratings)
208 students

Manipulação de Dados em Grande Escala com PySpark

Combine Python e Spark para realizar análises de dados em grandes volumes de maneira eficiente
Last updated 7/2024
Portuguese
Portuguese [Auto],

What you'll learn

  • Desenvolva suas habilidades de manipulação de dados com Spark utilizando programação em Python
  • Aprenda os conceitos e comandos fundamentais de programação em Python
  • Consultar dados de diversas origens e formatos, tratar e transformar esses dados para um formato adequado à análise, e explorar opções de armazenamento
  • Gerenciar grandes volumes de dados recebidos em lotes (em intervalos maiores) ou em tempo real
  • Utilize o poder do Spark para criar e otimizar modelos de Machine Learning
  • Como integrar nossos dados com ferramentas de visualização de dados

Course content

11 sections37 lectures9h 6m total length
  • Objetivo do curso e público alvo3:04
  • Vamos resumir o que veremos6:49
  • Vamos iniciar os trabalhos: configuração do ambiente de desenvolvimento9:37

Requirements

  • O único requisito é que tenha acesso a um computador com internet. Você não precisa conhecer programação, pois a intenção é ajudá-lo ensinando desde o básico até o avançado.

Description

Todas as empresas coletam e armazenam dados para diferentes finalidades. À medida que a empresa cresce, torna-se vital armazenar e processar esses dados de forma adequada e em grandes volumes. Com isso em mente, criei este curso com o objetivo de capacitar os alunos a manipular dados utilizando Python, uma linguagem amplamente reconhecida e a mais utilizada para esse propósito, juntamente com a poderosa biblioteca PySpark.

Vamos começar com os fundamentos da programação em Python e, em seguida, avançar para conteúdos mais complexos.

  • Para Analistas de Dados: Você aprenderá todo o processo, desde a consulta nas fontes de dados, passando pelas transformações necessárias, até a preparação dos dados no formato ideal para análise e visualização.

  • Para Cientistas de Dados: O conteúdo deste curso será inestimável para a limpeza de dados, aproveitando a capacidade de processamento do Spark, além de possibilitar o uso de bibliotecas de Machine Learning na construção de modelos preditivos.

  • Para Engenheiros de Dados: Assim como eu, você utilizará este curso para compreender os diferentes formatos de origem e destino dos dados e realizar transformações de dados brutos em formatos mais adequados, facilitando o trabalho dos analistas de dados. Além disso, você receberá diversas dicas para melhorar o desempenho das consultas e escolher a melhor estratégia de processamento.

Who this course is for:

  • Analista de Dados
  • Cientista de Dados
  • Engenheiro de Dados
  • Para aqueles que estão migrando para área de Dados