Udemy
    •  
    •  
    •  
    •  
    •  
    •  
    •  
    •  
Turn what you know into an opportunity and reach millions around the world.
Learn More
Your cart is empty.
Keep shopping
Fundamentos de Business Intelligence + Pyspark SPARK
Rating: 5.0 out of 5(6 ratings)
145 students

Fundamentos de Business Intelligence + Pyspark SPARK

Aprenda tudo sobre Business Intelligence e construa pipelines em Spark com python
Last updated 7/2025
Portuguese
Portuguese [Auto],

What you'll learn

  • Conceitos Básicos de Business Intelligence
  • Fundamentos de Business Intelligence
  • O que é um Data Warehouse
  • O que é Staging Area, ETL, OLAP, Data Mart, Data Mining, Big Data
  • BI (Business Intelligence) para Concursos
  • Resolução de 50 questões de BI dos Principais Concursos
  • Resumo BI em formato PDF com detalhes sobre todos os assuntos
  • O que é Data Mining
  • Definição sobre Big Data
  • O que é PYSPARK
  • O que é SPARK
  • Instalando o SPARK em um ambiente Windows, configurando
  • Instalando o ANACONDA
  • Instalando a JDK
  • Entendendo o ecossistema : Apache Spark + Anaconda + JAVA
  • Entendendo o conceito de NÓ, CLUSTER
  • Conhecendo os módulos e pacotes do PYSPARK
  • O que é SparkContext
  • Entendo o que é RDD (Resilient Distributed Dataset)
  • Trabalhando com Spark Dataframe
  • Compreendendo as diferenças entre transformações e ações, operações com PYSPARK
  • Operações: collect, count, parallelize, getNumPartitions, textFile, first, filter, cache, Show, take
  • Aprendendo o que é uma função Lambda
  • Operações: flatMap, map, reduceByKey, sortBY, join, leftOuterjoin, rightOuterjoin, select, groupBy, orderBy
  • Monitoramento de jobs com SPARK UI
  • O que é SparkSession
  • Leitura de arquivos externos
  • SPARK SQL
  • Leitura de dados em JSON

Course content

2 sections44 lectures6h 10m total length
  • Introdução7:46
  • INFORMAÇÕES IMPORTANTES - Leia antes de iniciar o curso0:26
  • O que é BI6:36
  • Data Warehouse6:44
  • OLTP x OLAP5:16
  • Características OLAP9:20
  • METADADOS2:58
  • Staging Area1:42
  • Dimensões4:04
  • Tabela Fato8:54
  • ETL3:08
  • Modelagem Dimensional4:27
  • Ferramentas Gratuitas e Pagas3:55
  • Conhecendo Data Mining11:00
  • BIG DATA e seu Objetivo3:43
  • Aula Final dos Conceitos de BI1:08
  • Resumo BI em PDF0:55
  • Solicitar seu Resumo BI em PDF0:30
  • Resolução de Questões - Parte 0122:13
  • Resolução de Questões - Parte 0210:13
  • Resolução de Questões - Parte 038:24
  • Resolução de Questões - Parte 0413:23
  • Resolução de Questões - Parte 058:53
  • Resolução de Questões - Parte 068:40
  • Resolução de Questões - Parte 076:42
  • Resolução de Questões - Parte 087:40
  • Resolução de Questões - Parte 097:40
  • Resolução de Questões - Parte 105:11
  • Vamos responder ao nosso Quiz?

Requirements

  • Noção Básica de Banco de Dados
  • Profissionais que, de alguma forma, utilizam dados no seu dia a dia
  • Conhecimento em Python

Description

Agora você estará aprendendo o que realmente interessa na área de dados com o entendimento sobre o mundo do Business Intelligence e tudo que existe sobre o assunto, alinhado a construção de projetos de dados avançados com o uso de Pyspark dentro do SPARK, implantando passo a passo a sua arquitetura.

Iniciaremos nosso treinamento com o RESUMO BI. Um Resumo Completo e Objetivo sobre os Fundamentos de Business Intelligence (BI), é assim que podemos considerar o Resumo BI - Fundamentos de Business Intelligence. Vamos te ajudar a entender os principais conceitos de Business Intelligence como O que é BI, Data Warehouse, OLTP, OLAP, Metadados, Modelagem Dimensional, Data Mining, Big Data, proporcionando a base necessária para oprofissional que quer entrar na áreade BI e ao mesmo tempo servindo de um excelente guia de referência para quem precisa de ummaterial objetivo de BI para concursos.

Depois aprenderemos de forma orquestrada, como funciona o pyspark,  que é uma API Python para Apache SPARK que é denominado como o mecanismo de processamento analítico para aplicações de processamento de dados distribuídos em larga escala e aprendizado de máquina, ou seja, para grandes volumes de dados.

O uso da biblioteca Pyspark possui diversas vantagens:

É um mecanismo de processamento distribuído, na memória, que permite o processamento de dados de forma eficiente e de características distribuída.

• Com o uso do PySpark, é possível o processamento de dados em Hadoop (HDFS), AWS S3 e outros sistemas de arquivos.

• Possui bibliotecas de aprendizado de máquina e gráficos.

• Geralmente as aplicações criadas e executadas no PySpark são 100x mais rápidas que outras em sistemas de dados conhecidos.


Então venha participar deste grupo de profissionais que utilizam estas tecnologias no seu dia a dia.

Who this course is for:

  • Profissionais de TI
  • Concurseiros
  • Profissionais que querem iniciar na área de Business Intelligence
  • Profissionais que já trabalham com Python para aprimorar seu conhecimento em SPARK