京公网安备 11010802034615号
经营许可证编号:京B2-20210330
大数据研发“学生画像” 谁会成为学霸可预测
一项研究发现,学生成绩的好坏与其行为习惯紧密相连
目前,川内各所大学即将开学。对于新入校的学生来说,大学生活该怎样合理安排?如何才能在大学里炼成一个学霸?
别担心,有大数据来告诉你!这不,由国内大数据领域的领军专家、电子科技大学教授周涛等人共同研发的“学生画像”系统,通过数据整合、分析,挖掘出每个学生的学习、生活状态,预测出学生的挂科危险以及可能出现的“特殊状况”。这个系统已经覆盖电子科大两万余名本科生。
从电子科大教育大数据研究所了解到了“学生画像”所统计出来的一些数据,那么,现在我们就来看下,在大学里怎样才能成为一个学霸。
1 新奇的发现
打水次数减少35次学生成绩相应降低了26名
电子科大教育大数据研究所成立于去年,数十名师生共同承担着我国多项教育研究课题。周涛曾介绍研究所说,数据中心集中了学校上万名学子的行为、消费等匿名信息,研究所基于这些数据,进行整合、分析与运用。
据介绍,目前学生的数据包括出入寝室的时间、进出图书馆的次数、借阅书籍的种类、在教学楼打水的次数、去澡堂洗澡的时间等。“学生画像”的研究团队首先会根据这些数据与实际行为的关联性,“计算”出每名学生的学习、生活状态,从而预测学生是否有挂科的可能,甚至还有辅导学生更好规划自己学业的可能。
通过这一年时间的大数据统计,可以看出,在电子科技大学:总体上,女生平均成绩好于男生;大二上学期,成绩两极化最为明显。
同时,还总结出一个规律,学生成绩波动之前,生活模式会先发生变化。比如,一名学生第一学期在教室打水的次数为53,他的成绩在565位同学中排名200;第二学期,这名学生的打水次数减少了35次,他的成绩也相应降低了26名。
2 如何成为学霸?
生活有规律多与成绩好的学生做朋友
通过大数据研究,其实可以发现,学霸也是有规律可循的。这不,教育大数据研究所根据这些数据,绘制出了“学霸”和“学渣”的学习生活轨迹。来,一起看下,想要成为学霸,你要做些什么?
一、去图书馆和教学楼次数越多,成绩越好
在大数据研究所提供的图表一上,记者可以看到,第一学期,成绩最好的学生进入图书馆的次数为55次,成绩最差的学生进入图书馆的次数为35次;到了第四学期,成绩最好的学生进入图书馆的次数为61次,成绩最差的学生进入图书馆的次数为18次。
正如图表所显示的,“学生画像”的研究团队通过大数据分析,发现出入图书馆次数比较多的学生,成绩要优于出入图书馆次数比较少的学生。而同一名学生,随着出入图书馆次数的增多或减少,成绩排名在上下浮动。
同样的情况也存在教学楼,学生去教学楼饮水机上打水次数越多,就说明学生长期在教学楼里活动。第三学期的数据显示(图二),成绩最好的学生在教学楼打水近80次,成绩最差的学生在教学楼打水不到10次。这也说明,经常在教学楼活动的学生,成绩就越好。
二、生活、学习有规律的学生,成绩更好研究人员通过分析全校本科生进出宿舍、在食堂吃饭、去澡堂洗澡等记录,发现成绩好的学生除了在教学楼打水次数比较多之外,生活、学习等行为习惯比成绩差的更有规律。
以吃早饭的次数为例(图三),第二学期,成绩最好的学生吃早餐次数在110次,成绩最差的学生吃早餐次数仅为60次。也就是说,9点前出现在食堂吃早餐的同学,成绩也相对更好。
除此之外,研究还发现,在固定时间进出宿舍,在宿舍的平均时长少的学生,成绩远远高于经常宅在宿舍的学生。
三、身边朋友成绩较好,自身成绩也相对较好
大数据显示,学霸的身边总是围绕着学霸,身边朋友成绩较好,自身成绩也相对较好。
电子科大教育大数据研究所有专门分析“朋友圈”的模块,主要分析同校的朋友。“两个朋友关系越亲密,共同行动的概率就越大,而陌生人之间则不然,这是已经经过仔细验证的结论。”基于此,研究所的专家们对学生们的共现频率进行了统计分析,凡是两两间较短间隔内在同一场所,研究人员都进行了记录,以此获取两人的关系亲密程度,超过某一亲密程度的则为朋友,以此获取每个人的朋友圈信息。此后,研究人员再结合学生基本信息,获取学生与朋友之间的标识,如室友、同班、同学院等,进而进一步分析学生的交际能力与偏好。
研究人员在分析了学生和朋友们之间的成绩之后,得出一个研究结果:学生自身成绩与身边朋友的成绩具有很强的相关性。
3 科研人员建议
大学新生们 这样做你也能成为“学霸”
基于以上的研究成果,教育大数据研究所也给出了一定的建议:
生活习惯很重要,请注意保持生活的规律性,早上6点起床跑步读书吃早餐而不是8点起床飞奔去上课,你这一天的感觉会完全不一样;
一定要抽时间锻炼身体,不要天天宅,睡懒觉和打游戏不如出去跑跑步,打打球;
不要迷恋网络游戏;入学就打好学习基础;多去教室图书馆学习。
4 挂科预警
推送给辅导员及时调整学生的学习状态
除了教你如何成为“学霸”之外,“学生画像”还可以帮学生预测成绩,发出“挂科预警”。
据介绍,挂科预警就是通过学生学习基础以及由日常行为特征体现出的努力程度,综合分析提前预测学生挂科可能性,并将挂科可能性较高的群体发送给辅导员,帮助他们提前引导,有效提升学生的学习成绩。
研究人员告诉记者,挂科预警主要从三个方面分析:一是刻画学生生活与学习的规律性。比如,如果某学生最近几个月作息极不规律,那么他的成绩就会有下滑的可能;二是分析课程相关性,先导课程的掌握程度对后续课程的成绩有大的影响。比如,如果某学生微积分—I分数在及格边缘,那么后续课程微积分—II就有较高的挂科可能性。三是计算学生在该课程上付出的精力。比如,如果发现该生在图书馆从未借阅与微积分课程相关的图书,那么他在该课上挂科的可能性会进一步提高。
依据这些分析,系统便可计算出学生的挂科可能性,类似于“电磁场与波有87.5%的可能性挂科”这样的信息就会推送给辅导员,由辅导员介入调整学生的学习状态。
5 如何保护隐私?
不强调个人情况对异常状况提供人文关怀
通过数据挖掘获知学生在校行为记录,这是否意味着学生的行踪被监控,侵犯了学生的隐私权?
其实不然。教育大数据研究所副所长连德富强调,如今,“大数据”已渗透到生活的各个领域。学校做数据收集,不会去强调每个人的情况,而是察看学生整体的学习生活状况,及时预测预警学生异常状况,为学校的决策提供数据支撑。比如,根据学生就业能力情况,学校及时开展个性化引导,提升学生就业水平;根据学生实际消费情况,找出隐性困难学生,提升学校人文关怀等。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在互联网产品运营、用户增长的实战场景中,很多从业者都会陷入一个误区:盲目投入资源做推广、拉新,却忽视了“拉新后的用户激活 ...
2026-02-06在机器学习建模过程中,特征选择是决定模型性能的关键环节——面对动辄几十、上百个特征的数据(如用户画像的几十项维度、企业经 ...
2026-02-06在CDA(Certified Data Analyst)数据分析师的日常实操中,表格结构数据是贯穿全流程的核心载体,而对表格数据类型的精准识别、 ...
2026-02-06在日常办公数据分析中,我们经常会面对杂乱无章的批量数据——比如员工月度绩效、产品销售数据、客户消费金额、月度运营指标等。 ...
2026-02-05在分类模型(如风控反欺诈、医疗疾病诊断、客户流失预警)的实操落地中,ROC曲线是评估模型区分能力的核心工具,而阈值则是连接 ...
2026-02-05对CDA(Certified Data Analyst)数据分析师而言,数据分析的价值不仅在于挖掘数据背后的规律与洞察,更在于通过专业的报告呈现 ...
2026-02-05在数据分析实战中,我们经常会遇到“多指标冗余”的问题——比如分析企业经营状况时,需同时关注营收、利润、负债率、周转率等十 ...
2026-02-04在数据分析场景中,基准比是衡量指标表现、评估业务成效、对比个体/群体差异的核心工具,广泛应用于绩效评估、业务监控、竞品对 ...
2026-02-04业务数据分析是企业日常运营的核心支撑,其核心价值在于将零散的业务数据转化为可落地的业务洞察,破解运营痛点、优化业务流程、 ...
2026-02-04在信贷业务中,违约率是衡量信贷资产质量、把控信用风险、制定风控策略的核心指标,其统计分布特征直接决定了风险定价的合理性、 ...
2026-02-03在数字化业务迭代中,AB测试已成为验证产品优化、策略调整、运营活动效果的核心工具。但多数业务场景中,单纯的“AB组差异对比” ...
2026-02-03企业战略决策的科学性,决定了其长远发展的格局与竞争力。战略分析方法作为一套系统化、专业化的思维工具,为企业研判行业趋势、 ...
2026-02-03在统计调查与数据分析中,抽样方法分为简单随机抽样与复杂抽样两大类。简单随机抽样因样本均匀、计算简便,是基础的抽样方式,但 ...
2026-02-02在数据驱动企业发展的今天,“数据分析”已成为企业经营决策的核心支撑,但实践中,战略数据分析与业务数据分析两个概念常被混淆 ...
2026-02-02在数据驱动企业发展的今天,“数据分析”已成为企业经营决策的核心支撑,但实践中,战略数据分析与业务数据分析两个概念常被混淆 ...
2026-02-02B+树作为数据库索引的核心数据结构,其高效的查询、插入、删除性能,离不开节点间指针的合理设计。在日常学习和数据库开发中,很 ...
2026-01-30在数据库开发中,UUID(通用唯一识别码)是生成唯一主键、唯一标识的常用方式,其标准格式包含4个短横线(如550e8400-e29b-41d4- ...
2026-01-30商业数据分析的价值落地,离不开标准化、系统化的总体流程作为支撑;而CDA(Certified Data Analyst)数据分析师,作为经过系统 ...
2026-01-30在数据分析、质量控制、科研实验等场景中,数据波动性(离散程度)的精准衡量是判断数据可靠性、稳定性的核心环节。标准差(Stan ...
2026-01-29在数据分析、质量检测、科研实验等领域,判断数据间是否存在本质差异是核心需求,而t检验、F检验是实现这一目标的经典统计方法。 ...
2026-01-29