Pular para o conteúdo principal

curso

Building Recommendation Engines with PySpark

Avançado

Updated 12/2024

Learn tools and techniques to leverage your own big data to facilitate positive experiences for your users.

Iniciar curso gratuitamente

Incluído gratuitamentePremium or Teams

SparkMachine learning4 horas15 vídeos56 exercícios4,550 XP12,286Declaração de Realização

Crie sua conta gratuita

Google LinkedIn Facebook

ou

Ao continuar, você aceita nossos Termos de Uso, nossa Política de Privacidade e que seus dados são armazenados nos EUA.

Treinar 2 ou mais pessoas?

Tentar DataCamp for Business

Amado por alunos de milhares de empresas

Descrição do curso

This course will show you how to build recommendation engines using Alternating Least Squares in PySpark. Using the popular MovieLens dataset and the Million Songs dataset, this course will take you step by step through the intuition of the Alternating Least Squares algorithm as well as the code to train, test and implement ALS models on various types of customer data.

Pré-requisitos

Introduction to PySpark Supervised Learning with scikit-learn

1

Recommendations Are Everywhere

Iniciar capítulo

Why learn how to build recommendation engines?

See the power of a recommendation engine

Power of recommendation engines

Recommendation engine types and data types

Collaborative vs content-based filtering

Collaborative vs content based filtering part II

Implicit vs explicit data

Ratings data types

Uses for recommendation engines

Alternate uses of recommendation engines.

Confirm understanding of latent features

2

How does ALS work?

Iniciar capítulo

Overview of matrix multiplication

Matrix multiplication

Matrix multiplication part II

Overview of matrix factorization

Matrix factorization

Non-negative matrix factorization

How ALS alternates to generate predictions

Estimating recommendations

RMSE as ALS alternates

Data preparation for Spark ALS

Correct format and distinct users

Assigning integer id's to movies

ALS parameters and hyperparameters

Build out an ALS model

Build RMSE evaluator

3

Recommending Movies

Iniciar capítulo

Introduction to the MovieLens dataset

Viewing the MovieLens Data

Calculate sparsity

The GroupBy and Filter methods

MovieLens Summary Statistics

View Schema

ALS model buildout on MovieLens Data

Create test/train splits and build your ALS model

Tell Spark how to tune your ALS model

Build your cross validation pipeline

Best Model and Best Model Parameters

Model Performance Evaluation

Generate predictions and calculate RMSE

Interpreting the RMSE

Do recommendations make sense

4

What if you don't have customer ratings?

Iniciar capítulo

Introduction to the Million Songs Dataset

Confirm understanding of implicit rating concepts

MSD summary statistics

Grouped summary statistics

Evaluating implicit ratings models

Specify ALS hyperparameters

Build implicit models

Running a cross-validated implicit ALS model

Extracting parameters

Overview of binary, implicit ratings

Binary model performance

Recommendations from binary data

Course recap

Building Recommendation Engines with PySpark

Curso
Completo

Declaração de Realização Earn

Adicione esta credencial ao seu perfil, currículo ou currículo do LinkedIn
Compartilhe nas redes sociais e em sua avaliação de desempenho

Incluído comPremium or Teams

Inscreva-se agora

Junte-se a mais 15 milhões de alunos e comece Building Recommendation Engines with PySpark Hoje!

Crie sua conta gratuita

Google LinkedIn Facebook

ou

Ao continuar, você aceita nossos Termos de Uso, nossa Política de Privacidade e que seus dados são armazenados nos EUA.