
CDA数据分析师 出品
作者:Mika
数据:真达
后期:Mika
【导读】
Show me data,用数据说话
今天我们聊一聊 《演员请就位2》,最近开播的国综里面,热度最高的一定是《演员请就位》了。从第一季起这部综艺就话题不断,金句频出,前有李诚儒老师的“如坐针毡,如芒刺背,如鲠在喉”;这一季,李诚儒老师再出金句,“味同嚼蜡,味如鸡肋,如此乏味”一度刷爆网络。
《演员请就位2》导师方面,除了上一季的陈凯歌、赵薇、郭敬明,还有这季加入的尔冬升导演,阵容上就十分有看点。参加的演员方面也有胡杏儿、黄奕、娄艺潇等熟悉的身影。
《演员2》一开播就热搜话题不断,无论是李诚儒老师、尔冬升导演的犀利点评,郭敬明给演技小白何昶希发S卡都能引起大量的讨论。
我们今天就用Python分析了《演员2》的视频弹幕,看看大家都在吐槽些什么。
01、豆瓣6.5分 《演员2》为啥差强人意?
《演员请就位》目前为止已经播出了两季,第一季在豆瓣为6.8分,共有4万余人评分。
而目前正在播出的第二季,已有1万9千多人评分,分数为6.5分,比上一季还低了0.3分。
分数占比
我们用Python分析了豆瓣的500条热评数据,从评分分布可以看到:
分数占比方面,37%的人给出1星,20.8%的人给出2星。给出5星好评的仅有5%。
豆瓣短评
那么短评中都在说些什么呢?
从评价词云图中可见,话题主要集中在郭敬明、尔冬升、陈凯歌、李诚儒几位嘉宾上。这也是《演员2》被诟病的一点,嘉宾导师比参赛的演员更出圈,更有话题。此外,"节目"、"演技"、"点评"等也是短评中常出现的。
导演提及
几位嘉宾导师中,谁被提到的次数最多呢?
进一步分析可见,郭敬明占据着最高的话题度,其次是尔冬升和陈凯歌。
导演评价
在对导演和主持嘉宾的评价也十分有意思,对郭敬明的差评达到60.66%,超过的半数,好评仅为14.22%。这与尔冬升的评价差距很大,后者的差评仅为28.83%,好评度也是最高的,达到了29.73%。而有趣的是,作为主持人的大鹏差评度居然比郭敬明还高,达到了67.27%。
02、分析45万条弹幕数据,看看大家都在吐槽什么
我们使用Python获取并分析了《演员请就位2》的腾讯弹幕数据,分析了目前播放的前五期。
1.1 数据读入
首先导入所需库。
# 导入库 import os import jieba import numpy as np import pandas as pd from pyecharts.charts import Bar, Pie, Line, WordCloud, Page from pyecharts import options as opts from pyecharts.globals import SymbolType, WarningType WarningType.ShowWarning = False import stylecloud from IPython.display import Image # 用于在jupyter lab中显示本地图
使用pandas循环读取数据。
# 读入数据 data_list = os.listdir('../data/') df_all = pd.DataFrame() for i in data_list: # print(i) df_one = pd.read_csv(f'../data/{i}', engine='python', encoding='utf-8', index_col=0) df_all = df_all.append(df_one, ignore_index=False) df_all.info()
<class 'pandas.core.frame.DataFrame'> Int64Index: 449762 entries, 0 to 44317 Data columns (total 7 columns): # Column Non-Null Count Dtype --- ------ -------------- ----- 0 episodes 449762 non-null object 1 comment_id 449762 non-null int64 2 oper_name 183066 non-null object 3 vip_degree 449762 non-null int64 4 content 449762 non-null object 5 time_point 449762 non-null int64 6 up_count 449762 non-null int64 dtypes: int64(4), object(3) memory usage: 27.5+ MB
共获取了前五期449762条弹幕数据。字段主要包括:期数、评论id、用户名、vip等级、评论内容、评论时间点和点赞数,数据预览如下:
df_all.head()
1.2 数据预处理
# 删除弹幕角色 df_all['content'] = df_all['content'].str.replace('(.*?:)', '') df_all.head()
1.3 数据可视化
弹幕走势图
先看到视频弹幕走势图,从数量上可以看到,弹幕数量前三的分别是:第一期上、第三期上、第五期上。而第一期下和第五期下的弹幕较少。
df_epinum = df_all['episodes'].value_counts().reset_index()
df_epinum['num'] = [1, 5, 3, 7, 6, 8, 4, 9, 2, 10]
df_epinum = df_epinum.sort_values('num')
df_epinum
x_data = df_epinum['index'].tolist()
y_data = df_epinum['episodes'].tolist()
# 条形图
bar1 = Bar(init_opts=opts.InitOpts(width='1350px', height='750px'))
bar1.add_xaxis(xaxis_data=x_data)
bar1.add_yaxis('', y_axis=y_data)
bar1.set_global_opts(title_opts=opts.TitleOpts(title='前五期的弹幕数走势图'),
visualmap_opts=opts.VisualMapOpts(max_=60000, is_show=False) ) bar1.render()
人物弹幕词云
我们接着再分别看到几位导演导师的弹幕词云。
——热门课程推荐:
想学习PYTHON数据分析与金融数字化转型精英训练营,您可以点击>>>“人才转型”了解课程详情;
想从事业务型数据分析师,您可以点击>>>“数据分析师”了解课程详情;
想从事大数据分析师,您可以点击>>>“大数据就业”了解课程详情;
想成为人工智能工程师,您可以点击>>>“人工智能就业”了解课程详情;
想了解Python数据分析,您可以点击>>>“Python数据分析师”了解课程详情;
想咨询互联网运营,你可以点击>>>“互联网运营就业班”了解课程详情;
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
基于 SPSS 的 ROC 曲线平滑调整方法与实践指南 摘要 受试者工作特征曲线(ROC 曲线)是评估诊断模型或预测指标效能的核心工具, ...
2025-08-25神经网络隐藏层神经元个数的确定方法与实践 摘要 在神经网络模型设计中,隐藏层神经元个数的确定是影响模型性能、训练效率与泛 ...
2025-08-25CDA 数据分析师与数据思维:驱动企业管理升级的核心力量 在数字化浪潮席卷全球的当下,数据已成为企业继人力、物力、财力之后的 ...
2025-08-25CDA数据分析师与数据指标:基础概念与协同逻辑 一、CDA 数据分析师:数据驱动时代的核心角色 1.1 定义与行业价值 CDA(Certified ...
2025-08-22Power Query 移动加权平均计算 Power Query 移动加权平均设置全解析:从原理到实战 一、移动加权平均法的核心逻辑 移动加权平均 ...
2025-08-22描述性统计:CDA数据分析师的基础核心与实践应用 一、描述性统计的定位:CDA 认证的 “入门基石” 在 CDA(Certified Data Analy ...
2025-08-22基于 Python response.text 的科技新闻数据清洗去噪实践 在通过 Python requests 库的 response.text 获取 API 数据后,原始数据 ...
2025-08-21基于 Python response.text 的科技新闻综述 在 Python 网络爬虫与 API 调用场景中,response.text 是 requests 库发起请求后获取 ...
2025-08-21数据治理新浪潮:CDA 数据分析师的战略价值与驱动逻辑 一、数据治理的多维驱动引擎 在数字经济与人工智能深度融合的时代,数据治 ...
2025-08-21Power BI 热力地图制作指南:从数据准备到实战分析 在数据可视化领域,热力地图凭借 “直观呈现数据密度与分布趋势” 的核心优势 ...
2025-08-20PyTorch 矩阵运算加速库:从原理到实践的全面解析 在深度学习领域,矩阵运算堪称 “计算基石”。无论是卷积神经网络(CNN)中的 ...
2025-08-20数据建模:CDA 数据分析师的核心驱动力 在数字经济浪潮中,数据已成为企业决策的核心资产。CDA(Certified Data Analyst)数据分 ...
2025-08-20KS 曲线不光滑:模型评估的隐形陷阱,从原因到破局的全指南 在分类模型(如风控违约预测、电商用户流失预警、医疗疾病诊断)的评 ...
2025-08-20偏态分布:揭开数据背后的非对称真相,赋能精准决策 在数据分析的世界里,“正态分布” 常被视为 “理想模型”—— 数据围绕均值 ...
2025-08-19CDA 数据分析师:数字化时代的价值创造者与决策智囊 在数据洪流席卷全球的今天,“数据驱动” 已从企业战略口号落地为核心 ...
2025-08-19CDA 数据分析师:善用 Power BI 索引列,提升数据处理与分析效率 在 Power BI 数据分析流程中,“数据准备” 是决定后续分析质量 ...
2025-08-18CDA 数据分析师:巧用 SQL 多个聚合函数,解锁数据多维洞察 在企业数据分析场景中,单一维度的统计(如 “总销售额”“用户总数 ...
2025-08-18CDA 数据分析师:驾驭表格结构数据的核心角色与实践应用 在企业日常数据存储与分析场景中,表格结构数据(如 Excel 表格、数据库 ...
2025-08-18PowerBI 累计曲线制作指南:从 DAX 度量到可视化落地 在业务数据分析中,“累计趋势” 是衡量业务进展的核心视角 —— 无论是 “ ...
2025-08-15Python 函数 return 多个数据:用法、实例与实战技巧 在 Python 编程中,函数是代码复用与逻辑封装的核心载体。多数场景下,我们 ...
2025-08-15