《你好,李焕英》票房破39亿,用Python分析一下这部春节档的最大黑马

本文的文字及图片来源于网络,仅供学习、交流使用,不具有任何商业用途,如有问题请及时联系我们以作处理。

以下文章来源于网易云课堂

Python爬虫、数据分析、网站开发等案例教程视频免费在线观看

https://space.bilibili.com/523606542

2021年的春节假期就这么结束了,本届春节档的中国电影总票房达到了78亿元!这还真是:就地过年催生“史上最强春节档”啊!

其中《唐人街探案3》率先打破多项记录,但因其广告植入又多又尴尬、剧情槽点过多等等差评使得口碑一度下滑,豆瓣评分更是从6.8分跌到了如今的5.6分,降到了烂片的行列。不过,它仍然进入了票房榜前五!

《你好,李焕英》票房破39亿,用Python分析一下这部春节档的最大黑马_第1张图片

 

与此同期,《你好,李焕英》从春节档第4天开始,不论是上座率、排片率、还是单日票房都实现了成功逆袭,成为春节档的最大黑马。

 

今天我们就用Python分析一下这位春节档的最大赢家——《你好,李焕英》!

《你好,李焕英》票房破39亿,用Python分析一下这部春节档的最大黑马_第2张图片

 

首先,我们要简单使用Python爬取豆瓣的短评数据。目前这部剧豆瓣上共有612433人进行评分,分数为8.1分,这种评分在国产剧中是很优秀的成绩了。

豆瓣电影对爬虫有反爬措施,建议使用selenium来爬取豆瓣评价以及评论者的个人信息。

from selenium import webdriver

静待几分钟,就成功获取了500条豆瓣评论数据

《你好,李焕英》票房破39亿,用Python分析一下这部春节档的最大黑马_第3张图片

 

简单筛选,我们就可以从500条数据统计出主演提及次数,并利用pyecharts制作条形图。

bar = (Bar()
      .add_xaxis(x_df)
      .add_yaxis('提及次数', y_df)
      .set_global_opts(title_opts=opts.TitleOpts(title='《你好,李焕英》豆瓣评论中的主演提及次数')
                      ,visualmap_opts=opts.VisualMapOpts())
    )

bar.render_notebook()

《你好,李焕英》票房破39亿,用Python分析一下这部春节档的最大黑马_第4张图片

 

我们通过排序可以发现,贾玲饰演的自己,张小斐饰演的李焕英是观众评论提及最多的角色。

凭借《你好,李焕英》这部电影,贾玲成为了中国票房最高女导演!饰演她母亲李焕英一角的张小斐也因此一炮而红!

 

提及次数第三名的是沈腾饰演的沈光林,许多网友们都在说“沈腾原本只是去客串《你好,李焕英》,结果一不小心成了主角,又一不小心成了150亿电影男演员。”

 

最后我们再利用stylecloud制作一个词云图,看看大家主要都在评论些什么?

 

stylecloud.gen_stylecloud(text=' '.join(text),
                         collocations=False,
                         icon_name='fas fa-chart-pie',
                         size=600,
                         output_name='./评论词云图.png')
Image(filename='./评论词云图.png')

 

结果如下:

《你好,李焕英》票房破39亿,用Python分析一下这部春节档的最大黑马_第5张图片

 

豆瓣评论中主要围绕的关键词有"母亲"和"女儿",以及对应的角色"贾玲"和"李焕英"。除此以外,"沈腾"、"穿越"、"反转"、"结尾"、"小品"等关键词也被多次提到。

上文就是我们用Python分析一下《你好,李焕英》这部叫好又叫座的电影了。

你可能感兴趣的:(数据分析,爬虫,python,数据分析,爬虫)