Udemy
    •  
    •  
    •  
    •  
    •  
    •  
    •  
    •  
Turn what you know into an opportunity and reach millions around the world.
Learn More
Your cart is empty.
Keep shopping
Alteryx TRIFACTA e Apache HOP: cargas e tratamento de dados
Rating: 4.3 out of 5(11 ratings)
468 students

Alteryx TRIFACTA e Apache HOP: cargas e tratamento de dados

Construa pipelines de dados e faça tratamento, governança e ajustes nos dados
Last updated 7/2025
Portuguese
Portuguese [Auto],

What you'll learn

  • Preparação de dados aberta que pode se conectar a diversas fontes de dados
  • Integração em todas as principais plataformas de dados em nuvem
  • Decida entre ETL ou ELT, ou uma combinação ideal dos dois com base no desempenho
  • Suporte para todas as principais nuvens, Google, AWS, Azure e on-premise
  • Interface intuitiva e simples utilização de objetos de dados
  • Perfilização de dados, ajudando na identificação de outliers
  • Tratamento de dados, criação de novos campos, dentre outras tarefas
  • Eliminação de dados nulos, inconsistências, criação de novos campos
  • Exploração e avaliação de conteúdo e de qualidade de qualquer conjunto de dados
  • Engenharia de dados com low-code, visual, direto na nuvem
  • Construção, implantação e automatização de pipelines de dados
  • Criação de flow de dados, que permite ao analista encadear suas ações de tratamento
  • Action com os dados: Columns, Rename, Sort, Calculate, Group By, Filter Rows, Replace
  • Action com os dados: Split, Create formula, dentre outros
  • Exportação dos resultados automatizados
  • O que é  Hop Orchestration Platform
  • Entendendo sobre fluxos de trabalho e pipelines
  • Entendendo sobre projetos e ambientes
  • Instalação do APACHE HOP
  • Criando pipelines com arquivos texto
  • Realizando tratamento de dados para entendimento do processo de engenharia de dados
  • O que são transformações, links e ações dentro de um pipeline
  • Construindo um workflow, orquestrador da sequência das operações
  • Entendendo o HOP GUI e seus componentes
  • Entendendo menu barras, principal e perspectivas
  • Criando sua área de projetos
  • Componentes pipelines: Sort, Select value, CSV file input, Value mapper, Filter rows, Dummy, Unique rows, Merge Join, Text File Output
  • Entendendo o que é : View output, Preview output , Debug output
  • Componentes pipelines: Number Range, Concat Field, String Operations, Replace in String, IF Field Value is Null, Split Fields, CSV File Input, Mail, File Exist
  • Leitura de dados em uma API: Rest Client, JSON Input, JSON Output
  • Construindo Workflow com execução de pipelines
  • Entendo o uso de variáveis globais no APACHE HOP
  • Automatização de pipeline ou workflow pelo HOP-RUN
  • Construindo pipelines em banco de dados Postgresql: Table Input, Table Output, Configurando conexão
  • Instalação de banco de dados Postgresql, usando PGAdmin

Course content

2 sections48 lectures6h 29m total length
  • O que é o Alteryx TRIFACTA5:47
  • Apresentação da Ferramenta e arquitetura12:19
  • INFORMAÇÕES IMPORTANTES! - Leia antes de começar o curso0:23
  • Carregando os dados e fazendo Explorer dos dados15:30
  • Action Substituir - Tratamento de dados - parte 019:54
  • Action Rename e Sort - Tratamento de dados - parte 028:50
  • Action Move e Hide - Tratamento de dados - parte 034:30
  • Action Format - Tratamento de dados - parte 047:55
  • Action Calculate - Tratamento de dados - parte 0510:06
  • Action Create Columns From Examples - Tratamento de dados - parte 067:17
  • Action Extract - Tratamento de dados - parte 077:48
  • Action Split Column - Tratamento de dados - parte 0810:36
  • Action Merge - Tratamento de dados - parte 092:36
  • Action Group By - Tratamento de dados - parte 106:10
  • Action Filtro - Tratamento de dados - parte 119:23
  • Aplicação de Funções de Controle5:28
  • Aplicação de Funções Especiais12:52
  • Executando o Fluxo de dados e gerando arquivo de saída9:50
  • Gerando o agendamento (Schedule) do Fluxo de Dados3:38
  • Aula Final - Atividade para entrega3:34

Requirements

  • Importante ter conhecimento sobre banco de dados, arquivos de dados
  • Importante que você conheça lógica de programação

Description

Este treinamento foi construido como um dos mais práticos e principais da área de preparação de dados. Utilizaremos duas das mais importantes ferramentas de mercado que fazem o trabalho de preparação de dados, governaça de dados e ajustes nos dados, estamos falando Alteryx TRIFACTA e do APACHE HOP.

O Alteryx TRIFACTA, é uma ferramenta 100% na nuvem, low-code, totalmente prática e com grande destaque no mercado. Ela é uma plataforma em nuvem aberta e interativa, que permite a capacitação de engenheiros de dados e analistas a interpretar, preparar e criar pipelines de dados para acelerar suas análises.


As principais características do Alteryx TRIFACTA são:

  • Explore e avalie o conteúdo e a qualidade de qualquer conjunto de dados.

  • Acelere e acompanhe transformações de dados de forma visual.

  • Construa, implante e automatize pipelines de dados.

  • Utilize os fluxos de dados para definir TODAS as suas necessidades em tratamento de dados e governança de dados


O APACHE HOP é a abreviação de Hop Orchestration Platform, é uma plataforma de orquestração de dados e engenharia de dados que visa facilitar todos os aspectos da orquestração de dados e metadados, por padrão o HOP vem com cerca de 400 plugins ou componentes.

São criados fluxos de trabalho (Workflow) e pipelines em um ambiente de desenvolvimento visual chamado Hop Gui.

Com o APACHE HOP é possível combinar, enriquecer, limpar e de muitas outras maneiras manipular dados.

A ideia é que você faça a leitura de dados, realize os ajustes e tratamentos no conteúdo (limpeza de inconsistências, criação de campos, composição de campos, dentre outros).

Para você que pretende ou trabalha com engenharia de dados é a ferramenta perfeita.

O curso cobre todo o ciclo desde o START da construção do pipeline ou workflow até a automatização deste.


Então venha para o nosso treinamento e promova a exploração sobre seus dados com alta performance.

Who this course is for:

  • Profissionais de TI
  • Profissionais que querem trabalham na área de Engenharia de dados, Análise de dados, Ciência de Dados, Business Intelligence
  • Pessoas interessadas em aprender os conceitos sobre ferramentas de ingestão de dados, ou que gostariam adentrar na área de engenharia de dados
  • Profissionais que, de alguma forma, utilizam dados no seu dia a dia