关键信息
关于内容
Gain a deeper understanding of Spark by learning about its APIs, architecture, and common use cases. This statistics and data analysis course will cover material relevant to both data engineers and data scientists. You’ll learn how Spark efficiently transfers data across the network via its shuffle, details of memory management, optimizations to reduce compute costs, and more. Learners will see several use cases for Spark and will work to solve a variety of real-world problems using public datasets. After taking this course, you should have a thorough understanding of how Spark works and how you can best utilize its APIs to write efficient, scalable code. You’ll also learn about a wide variety of Spark’s APIs, including the APIs in Spark Streaming.
课程大纲
- Common use cases for Spark
- Details of internals like the shuffle, Spark SQL’s Catalyst Optimizer, and Project Tungsten
- A deep architectural overview
- Spark Streaming
- Spark ML
教师
- Anthony D. Joseph
- Jon Bates
内容设计师

平台

EdX est une plateforme d'apprentissage en ligne (dite FLOT ou MOOC). Elle héberge et met gratuitement à disposition des cours en ligne de niveau universitaire à travers le monde entier. Elle mène également des recherches sur l'apprentissage en ligne et la façon dont les utilisateurs utilisent celle-ci. Elle est à but non lucratif et la plateforme utilise un logiciel open source.
EdX a été fondée par le Massachusetts Institute of Technology et par l'université Harvard en mai 2012. En 2014, environ 50 écoles, associations et organisations internationales offrent ou projettent d'offrir des cours sur EdX. En juillet 2014, elle avait plus de 2,5 millions d'utilisateurs suivant plus de 200 cours en ligne.
Les deux universités américaines qui financent la plateforme ont investi 60 millions USD dans son développement. La plateforme France Université Numérique utilise la technologie openedX, supportée par Google.