Scrapped tweets using twitter API (for keyword ‘Netflix’) on an AWS EC2 instance, ingested data into S3 via kinesis firehose. Used Spark ML on databricks to build a pipeline for sentiment classification model and Athena & QuickSight to build a dashboard
twitter-api aws-s3 python3 pyspark aws-ec2 twitter-sentiment-analysis aws-athena aws-kinesis-firehose count-vectorizer databricks-notebooks tf-idf-vectorizer accuracy-metrics aws-quicksight roc-auc-score multiclass-evaluator
-
Updated
May 2, 2022 - Jupyter Notebook