Introdução ao Big Data com Apache Spark – UC BerkeleyX

Conteúdo

Este curso tentará articular a produção esperada dos cientistas de dados e, em seguida, ensinar aos alunos como usar o PySpark (parte de Apache Spark) para atender a essas expectativas. As atribuições do curso incluem exercícios de mineração de toras, credenciamento de entidade textual e filtragem colaborativa que ensinam os alunos a manipular conjuntos de dados por meio de processamento paralelo com PySpark.

Assine a nossa newsletter

Nós não enviaremos SPAM para você. Nós odiamos isso tanto quanto você.

Datapeaker