Insights práticos, exemplos reais e espaço para perguntas ao vivo. PARTICIPE DA LIVE GRATUITA

Apache Spark: Fundamentos de Processamento em Escala

Um dos primeiros desafios enfrentados por profissionais que começam a trabalhar com grandes volumes de dados é perceber que ferramentas tradicionais deixam de ser suficientes quando os dados crescem em volume, variedade e velocidade. Planilhas, scripts isolados e consultas simples não escalam, exigindo uma abordagem distribuída.

20 horas Ao vivo Iniciante
Apache Spark: Fundamentos de Processamento em Escala
Engenharia de Dados

Explore mais sobre o curso

O curso Apache Spark – Fundamentos de Processamento de Dados em Escala foi desenvolvido para profissionais que estão iniciando em Engenharia de Dados e precisam entender como o Spark funciona na prática, qual seu papel no ecossistema de Big Data e como processar dados de forma distribuída. Neste nível, o foco está na compreensão do modelo de processamento do Spark, em seus principais componentes e no uso inicial do Spark para leitura, transformação e análise básica de dados. O curso prepara o participante para entender pipelines existentes, executar transformações simples e dialogar tecnicamente com equipes mais experientes, formando a base necessária para evolução no uso do Spark como Data Engineer Júnior.

Módulos do Curso

  • O desafio do processamento de dados em escala O papel do Apache Spark em engenharia de dados
  • Onde o Spark se encaixa no ecossistema Big Data O papel do Apache Spark em engenharia de dados
  • Casos de uso comuns do Spark no mercado O papel do Apache Spark em engenharia de dados
  • Driver, executors e cluster Arquitetura e conceitos fundamentais do Spark
  • Processamento distribuído Arquitetura e conceitos fundamentais do Spark
  • Resiliência e paralelismo Arquitetura e conceitos fundamentais do Spark
  • SparkSession e contexto de execução Spark APIs e primeiros usos
  • DataFrames e Dataset Spark APIs e primeiros usos
  • Leitura e escrita de dados Spark APIs e primeiros usos
  • Operações comuns em DataFrames Transformações e ações básicas
  • Transformações vs. ações Transformações e ações básicas
  • Avaliação preguiçosa (lazy evaluation) Transformações e ações básicas
  • Leitura correta dos dados Boas práticas em Apache Spark
  • Erros comuns de iniciantes Boas práticas em Apache Spark
  • Base para evolução no Spark Boas práticas em Apache Spark

Confira tudo que voce vai dominar neste curso.

Investimento

20 horas para transformar seus dados em vantagem competitiva.

  • 20 horas de conteúdo
  • Certificado de conclusão
  • Roadmap pronto
  • Material didático com conteúdo completo
  • Aulas prontas disponíveis por 3 meses

Garanta sua vaga na próxima turma*

Escolha a data que melhor se encaixa na sua agenda e confirme sua inscrição.

Inscreva-se agora!

Flexibilidade online + prática presencial

Formação completa com conteúdo online e encontros práticos.

Inscreva-se agora
  • 20 horas de conteúdo
  • Certificado de conclusão
  • Roadmap pronto
  • Material didático com conteúdo completo
  • Aulas prontas disponíveis por 3 meses

Nossas jornadas mais populares

Este curso pode fazer parte de uma ou mais jornadas, que reúnem formações relacionadas

Garanta sua vaga na próxima turma*

Escolha a data que melhor se encaixa na sua agenda e confirme sua inscrição.

Garanta sua vaga na próxima turma*
Compreensão do papel do Apache Spark no processamento de dados em escala
Entendimento da arquitetura e do modelo distribuído do Spark
Uso inicial de DataFrames para leitura e transformação de dados
Aplicação de transformações e ações em pipelines simples
Interpretação básica do comportamento do Spark em execução
Base técnica sólida para evolução no uso profissional do Spark
Profissionais iniciantes em Engenharia de Dados
Analistas ou desenvolvedores em transição para Big Data
Cientistas de dados que precisam processar dados em escala
Pessoas iniciando contato com Apache Spark no trabalho
Conhecimento básico de dados e estruturas tabulares
Noções iniciais de programação (Python, Scala ou SQL)
Não é necessário conhecimento prévio em Apache Spark
Especialistas
Mathias Brem Analytics Expert e Cofundador da Rox Partner