Building Batch Data Analytics Solutions on AWS (GK7378)
Om kurset
In this course, you will learn to build batch data analytics solutions using Amazon EMR, an enterprise-grade Apache Spark and Apache Hadoop managed service. You will learn how Amazon EMR integrates with open-source projects such as Apache Hive, Hue, and HBase, and with AWS services such as AWS Glue and AWS Lake Formation. The course addresses data collection, ingestion, cataloging, storage, and processing components in the context of Spark and Hadoop. You will learn to use EMR Notebooks to support both analytics and machine learning workloads. You will also learn to apply security, performance, and cost management best practices to the operation of Amazon EMR.
Dette lærer du
Kursinnhold
Kurset dekker blant annet følgende temaer:
- Module A: Overview of Data Analytics and the Data Pipeline
- Module 1: Introduction to Amazon EMR
- Module 2: Data Analytics Pipeline Using Amazon EMR: Ingestion and Storage
- Module 3: High-Performance Batch Data Analytics Using Apache Spark on Amazon EMR
- Module 4: Processing and Analyzing Batch Data with Amazon EMR and Apache Hive
- Module 5: Serverless Data Processing
- Module 6: Security and Monitoring of Amazon EMR Clusters
- Module 7: Designing Batch Data Analytics Solutions
- Module B: Developing Modern Data Architectures on AWS
Forkunnskaper
Hvem passer kurset for?
Videre kurs
Kursdatoer
Hvorfor velge SG Partner?
Vi gjør det enkelt å finne riktig kurs og riktig gjennomføring for deg og din virksomhet.
Offisielle kurs
Kursinnhold fra anerkjente teknologileverandører og fagmiljøer.
Erfarne instruktører
Praktisk og faglig undervisning med fokus på kompetanse du kan bruke.
Fleksibel gjennomføring
Velg mellom tilgjengelige virtuelle, fysiske og bedriftsinterne kurs.
Personlig rådgivning
Vi hjelper deg med å finne kurs og kompetanseløp som passer behovet ditt.
Ofte stilte spørsmål
Hvor lenge varer kurset?
Kursets oppgitte varighet er 1.
Kan jeg ta en sertifisering?
Kurset kan være relevant som forberedelse til sertifisering. Se kursbeskrivelsen for informasjon om aktuell sertifisering og eksamen.
Hvilke forkunnskaper trenger jeg?
Students with a minimum one-year experience managing open-source data frameworks such as Apache Spark or Apache Hadoop will benefit from this course.
Hvem passer kurset for?
This course is intended for: • Data platform engineers • Architects and operators who build and manage data analytics pipelines
Kan kurset leveres som bedriftsinternt kurs?
Ja.
Kan kurset tas virtuelt?
Ja. Det finnes kommende kursdatoer med Virtual gjennomføring.
Hvor kan kurset leveres?
Kurset kan leveres over hele Norge, blant annet i Oslo, Kristiansand, Stavanger, Bergen, Trondheim og Tromsø.
