Big Data Integration and Processing

Big Data Integration and Processing

Archived
Cours
en
Anglais
20 h
Ce contenu est noté 0 sur 5

Vous ne pouvez pas accéder à un cours au statut archivé.

Source
  • Sur www.coursera.org
Conditions
  • À son rythme
  • Accès libre
  • Certificat payant
Plus d'informations
  • 6 séquences
  • Niveau Introductif

Vous ne pouvez pas accéder à un cours au statut archivé.

Their employees are learning daily with Edflex

  • Safran
  • Air France
  • TotalEnergies
  • Generali
Découvrir Edflex

Détails du cours

Déroulé

  • Week 1 - Welcome to Big Data Integration and Processing
    Welcome to the third course in the Big Data Specialization. This week you will be introduced to basic concepts in big data integration and processing. You will be guided through installing the Cloudera VM, downloading the data sets to be used for this course, ...
  • Week 1 - Retrieving Big Data (Part 1)
    This module covers the various aspects of data retrieval and relational querying. You will also be introduced to the Postgres database.
  • Week 2 - Retrieving Big Data (Part 2)
    This module covers the various aspects of data retrieval for NoSQL data, as well as data aggregation and working with data frames. You will be introduced to MongoDB and Aerospike, and you will learn how to use Pandas to retrieve data from them.
  • Week 3 - Big Data Integration
    In this module you will be introduced to data integration tools including Splunk and Datameer, and you will gain some practical insight into how information integration processes are carried out.
  • Week 4 - Processing Big Data
    This module introduces Learners to big data pipelines and workflows as well as processing and analysis of big data using Apache Spark.
  • Week 5 - Big Data Analytics using Spark
    In this module, you will go deeper into big data processing by learning the inner workings of the Spark Core. You will be introduced to two key tools in the Spark toolkit: Spark MLlib and GraphX.
  • Week 6 - Learn By Doing: Putting MongoDB and Spark to Work
    In this module you will get some practical hands-on experience applying what you learned about Spark and MongoDB to analyze Twitter data.

Prérequis

Aucun.

Intervenants

Ilkay Altintas
Chief Data Science Officer
San Diego Supercomputer Center

Amarnath Gupta
Director, Advanced Query Processing Lab
San Diego Supercomputer Center (SDSC)

Éditeur

L' Université de Californie à San Diego est une université publique de recherche sur les concessions de terres à San Diego, en Californie. Établi en 1960 près de la Scripps Institution of Oceanography préexistante, l'UC San Diego est le plus méridional des dix campus de l' Université de Californie et offre plus de 200 programmes menant à un diplôme de premier cycle et des cycles supérieurs, recrutant 33 096 étudiants de premier cycle et 9 872 étudiants des cycles supérieurs. 

L'UC San Diego est considérée comme l'une des meilleures universités au monde. Plusieurs publications ont classé les départements de sciences biologiques et d'informatique de l'UC San Diego parmi les 10 meilleurs au monde.

Plateforme

Coursera est une entreprise numérique proposant des formations en ligne ouverte à tous fondée par les professeurs d'informatique Andrew Ng et Daphne Koller de l'université Stanford, située à Mountain View, Californie.

Ce qui la différencie le plus des autres plateformes MOOC, c'est qu'elle travaille qu'avec les meilleures universités et organisations mondiales et diffuse leurs contenus sur le web.

Ce contenu est noté 4.5 sur 5
(aucun avis)
Ce contenu est noté 4.5 sur 5
(aucun avis)
Complétez cette ressource pour donner votre avis