京公网安备 11010802034615号
经营许可证编号:京B2-20210330
大数据研发“学生画像” 谁会成为学霸可预测
一项研究发现,学生成绩的好坏与其行为习惯紧密相连
目前,川内各所大学即将开学。对于新入校的学生来说,大学生活该怎样合理安排?如何才能在大学里炼成一个学霸?
别担心,有大数据来告诉你!这不,由国内大数据领域的领军专家、电子科技大学教授周涛等人共同研发的“学生画像”系统,通过数据整合、分析,挖掘出每个学生的学习、生活状态,预测出学生的挂科危险以及可能出现的“特殊状况”。这个系统已经覆盖电子科大两万余名本科生。
从电子科大教育大数据研究所了解到了“学生画像”所统计出来的一些数据,那么,现在我们就来看下,在大学里怎样才能成为一个学霸。
1 新奇的发现
打水次数减少35次学生成绩相应降低了26名
电子科大教育大数据研究所成立于去年,数十名师生共同承担着我国多项教育研究课题。周涛曾介绍研究所说,数据中心集中了学校上万名学子的行为、消费等匿名信息,研究所基于这些数据,进行整合、分析与运用。
据介绍,目前学生的数据包括出入寝室的时间、进出图书馆的次数、借阅书籍的种类、在教学楼打水的次数、去澡堂洗澡的时间等。“学生画像”的研究团队首先会根据这些数据与实际行为的关联性,“计算”出每名学生的学习、生活状态,从而预测学生是否有挂科的可能,甚至还有辅导学生更好规划自己学业的可能。
通过这一年时间的大数据统计,可以看出,在电子科技大学:总体上,女生平均成绩好于男生;大二上学期,成绩两极化最为明显。
同时,还总结出一个规律,学生成绩波动之前,生活模式会先发生变化。比如,一名学生第一学期在教室打水的次数为53,他的成绩在565位同学中排名200;第二学期,这名学生的打水次数减少了35次,他的成绩也相应降低了26名。
2 如何成为学霸?
生活有规律多与成绩好的学生做朋友
通过大数据研究,其实可以发现,学霸也是有规律可循的。这不,教育大数据研究所根据这些数据,绘制出了“学霸”和“学渣”的学习生活轨迹。来,一起看下,想要成为学霸,你要做些什么?
一、去图书馆和教学楼次数越多,成绩越好
在大数据研究所提供的图表一上,记者可以看到,第一学期,成绩最好的学生进入图书馆的次数为55次,成绩最差的学生进入图书馆的次数为35次;到了第四学期,成绩最好的学生进入图书馆的次数为61次,成绩最差的学生进入图书馆的次数为18次。
正如图表所显示的,“学生画像”的研究团队通过大数据分析,发现出入图书馆次数比较多的学生,成绩要优于出入图书馆次数比较少的学生。而同一名学生,随着出入图书馆次数的增多或减少,成绩排名在上下浮动。
同样的情况也存在教学楼,学生去教学楼饮水机上打水次数越多,就说明学生长期在教学楼里活动。第三学期的数据显示(图二),成绩最好的学生在教学楼打水近80次,成绩最差的学生在教学楼打水不到10次。这也说明,经常在教学楼活动的学生,成绩就越好。
二、生活、学习有规律的学生,成绩更好研究人员通过分析全校本科生进出宿舍、在食堂吃饭、去澡堂洗澡等记录,发现成绩好的学生除了在教学楼打水次数比较多之外,生活、学习等行为习惯比成绩差的更有规律。
以吃早饭的次数为例(图三),第二学期,成绩最好的学生吃早餐次数在110次,成绩最差的学生吃早餐次数仅为60次。也就是说,9点前出现在食堂吃早餐的同学,成绩也相对更好。
除此之外,研究还发现,在固定时间进出宿舍,在宿舍的平均时长少的学生,成绩远远高于经常宅在宿舍的学生。
三、身边朋友成绩较好,自身成绩也相对较好
大数据显示,学霸的身边总是围绕着学霸,身边朋友成绩较好,自身成绩也相对较好。
电子科大教育大数据研究所有专门分析“朋友圈”的模块,主要分析同校的朋友。“两个朋友关系越亲密,共同行动的概率就越大,而陌生人之间则不然,这是已经经过仔细验证的结论。”基于此,研究所的专家们对学生们的共现频率进行了统计分析,凡是两两间较短间隔内在同一场所,研究人员都进行了记录,以此获取两人的关系亲密程度,超过某一亲密程度的则为朋友,以此获取每个人的朋友圈信息。此后,研究人员再结合学生基本信息,获取学生与朋友之间的标识,如室友、同班、同学院等,进而进一步分析学生的交际能力与偏好。
研究人员在分析了学生和朋友们之间的成绩之后,得出一个研究结果:学生自身成绩与身边朋友的成绩具有很强的相关性。
3 科研人员建议
大学新生们 这样做你也能成为“学霸”
基于以上的研究成果,教育大数据研究所也给出了一定的建议:
生活习惯很重要,请注意保持生活的规律性,早上6点起床跑步读书吃早餐而不是8点起床飞奔去上课,你这一天的感觉会完全不一样;
一定要抽时间锻炼身体,不要天天宅,睡懒觉和打游戏不如出去跑跑步,打打球;
不要迷恋网络游戏;入学就打好学习基础;多去教室图书馆学习。
4 挂科预警
推送给辅导员及时调整学生的学习状态
除了教你如何成为“学霸”之外,“学生画像”还可以帮学生预测成绩,发出“挂科预警”。
据介绍,挂科预警就是通过学生学习基础以及由日常行为特征体现出的努力程度,综合分析提前预测学生挂科可能性,并将挂科可能性较高的群体发送给辅导员,帮助他们提前引导,有效提升学生的学习成绩。
研究人员告诉记者,挂科预警主要从三个方面分析:一是刻画学生生活与学习的规律性。比如,如果某学生最近几个月作息极不规律,那么他的成绩就会有下滑的可能;二是分析课程相关性,先导课程的掌握程度对后续课程的成绩有大的影响。比如,如果某学生微积分—I分数在及格边缘,那么后续课程微积分—II就有较高的挂科可能性。三是计算学生在该课程上付出的精力。比如,如果发现该生在图书馆从未借阅与微积分课程相关的图书,那么他在该课上挂科的可能性会进一步提高。
依据这些分析,系统便可计算出学生的挂科可能性,类似于“电磁场与波有87.5%的可能性挂科”这样的信息就会推送给辅导员,由辅导员介入调整学生的学习状态。
5 如何保护隐私?
不强调个人情况对异常状况提供人文关怀
通过数据挖掘获知学生在校行为记录,这是否意味着学生的行踪被监控,侵犯了学生的隐私权?
其实不然。教育大数据研究所副所长连德富强调,如今,“大数据”已渗透到生活的各个领域。学校做数据收集,不会去强调每个人的情况,而是察看学生整体的学习生活状况,及时预测预警学生异常状况,为学校的决策提供数据支撑。比如,根据学生就业能力情况,学校及时开展个性化引导,提升学生就业水平;根据学生实际消费情况,找出隐性困难学生,提升学校人文关怀等。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
日常用Excel做数据管理、台账维护、报表整理时,添加备注列是高频操作——用来标注异常、说明业务背景、记录处理进度、补充关键 ...
2026-03-23作为业内主流的自助式数据可视化工具,Tableau凭借拖拽式操作、强大的数据联动能力、灵活的仪表板搭建,成为数据分析师、业务人 ...
2026-03-23在CDA(Certified Data Analyst)数据分析师的日常工作与认证考核中,分类变量的关联分析是高频核心场景。用户性别是否影响商品 ...
2026-03-23在数据工作的全流程中,数据清洗是最基础、最耗时,同时也是最关键的核心环节,无论后续是做常规数据分析、可视化报表,还是开展 ...
2026-03-20在大数据与数据驱动决策的当下,“数据分析”与“数据挖掘”是高频出现的两个核心概念,也是很多职场人、入门学习者容易混淆的术 ...
2026-03-20在CDA(Certified Data Analyst)数据分析师的全流程工作闭环中,统计制图是连接严谨统计分析与高效业务沟通的关键纽带,更是CDA ...
2026-03-20在MySQL数据库优化中,分区表是处理海量数据的核心手段——通过将大表按分区键(如时间、地域、ID范围)分割为多个独立的小分区 ...
2026-03-19在商业智能与数据可视化领域,同比、环比增长率是分析数据变化趋势的核心指标——同比(YoY)聚焦“长期趋势”,通过当前周期与 ...
2026-03-19在数据分析与建模领域,流传着一句行业共识:“数据决定上限,特征决定下限”。对CDA(Certified Data Analyst)数据分析师而言 ...
2026-03-19机器学习算法工程的核心价值,在于将理论算法转化为可落地、可复用、高可靠的工程化解决方案,解决实际业务中的痛点问题。不同于 ...
2026-03-18在动态系统状态估计与目标跟踪领域,高精度、高鲁棒性的状态感知是机器人导航、自动驾驶、工业控制、目标检测等场景的核心需求。 ...
2026-03-18“垃圾数据进,垃圾结果出”,这是数据分析领域的黄金法则,更是CDA(Certified Data Analyst)数据分析师日常工作中时刻恪守的 ...
2026-03-18在机器学习建模中,决策树模型因其结构直观、易于理解、无需复杂数据预处理等优势,成为分类与回归任务的首选工具之一。而变量重 ...
2026-03-17在数据分析中,卡方检验是一类基于卡方分布的假设检验方法,核心用于分析分类变量之间的关联关系或实际观测分布与理论期望分布的 ...
2026-03-17在数字化转型的浪潮中,企业积累的数据日益庞大且分散——用户数据散落在注册系统、APP日志、客服记录中,订单数据分散在交易平 ...
2026-03-17在数字化时代,数据分析已成为企业决策、业务优化、增长突破的核心支撑,从数据仓库搭建(如维度表与事实表的设计)、数据采集清 ...
2026-03-16在数据仓库建设、数据分析(尤其是用户行为分析、业务指标分析)的实践中,维度表与事实表是两大核心组件,二者相互依存、缺一不 ...
2026-03-16数据是CDA(Certified Data Analyst)数据分析师开展一切工作的核心载体,而数据读取作为数据生命周期的关键环节,是连接原始数 ...
2026-03-16在用户行为分析实践中,很多从业者会陷入一个核心误区:过度关注“当前数据的分析结果”,却忽视了结果的“泛化能力”——即分析 ...
2026-03-13在数字经济时代,用户的每一次点击、浏览、停留、转化,都在传递着真实的需求信号。用户行为分析,本质上是通过收集、整理、挖掘 ...
2026-03-13