京公网安备 11010802034615号
经营许可证编号:京B2-20210330
教育大数据成教育领域热点:想说爱你不容易
近两年,“大数据”在教育领域日益成为热点名词,和“在线教育”相呼应。从今年新东方、学大等教育机构发布的教育产品来看,几乎每一款产品都会提到大数据。既然如此受到重视,那么在当下教育领域,“大数据”有何特点?又有何作为?
专家指出,目前国内教育领域的“大数据”仍处于概念阶段,大家都在起步和探索过程中,尚无比较成功的大数据应用案例,不少大数据应用也都处于较浅的层次。不过,随着教育大数据的不断积累和深入发展,“大数据”必将有利于我们的个性化教育,对教学和管理产生深刻影响。
随着“大数据”概念不断升温,教育行业如今也被认为是大数据可以大有作为的一个重要应用领域。几乎每家不甘落后的教育机构都在拥抱大数据,把大数据当作在激烈竞争中脱颖而出的秘密武器。
“其实,十几年前我们就在做数据仓库和数据挖掘。如今大数据这个概念兴起,主要基于两点,一是数据海量增长,处理样本数变多;二是物理运算能力增强,给处理海量数据带来可能。”在计算机博士、朗播网CEO杜昶旭看来,大数据既没有那么神秘,但也不像有些人想象得那么简单。
干扰性数据多影响统计分析精度
杜昶旭认为,与其他行业的大数据相比,教育行业大数据目前数据量比较小,教育数据噪声也比较高。他解释,目前在线教育不像电商,用户数量庞大,数据可以累积到海量。而且教育垂直属性特别明显,大量数据会分流向不同垂直领域。
而不同垂直领域之间的数据融合度比较低,比如语文和数学的数据很难放到一起来分析;数据噪声简单讲指干扰性数据、无用数据,比如录播视频,用户行为很简单,有暂停、关闭、重看等等,但是这些操作的原因很多,并不一定是没看懂内容,所以干扰性数据非常多,数据统计分析的精度会受影响。
“此外,教育数据标准化程度非常低。数据大致可分为结构化数据和非结构化数据。以描述人一个人打比方,结构化数据就是人的身高、体重、性别;非结构化数据则可以是人的声音、照片等。”杜昶旭说,很多教育数据比如视频数据、语音数据等都是非结构化数据,数据模型构建会比较复杂,“所以,教育大数据需要解决数据量和数据处理的问题。”
优质技术分析要有一流试题保障
互联网教育研究院院长吕森林也指出,教育大数据分析并不是有数据就可以,如果数据中有很多垃圾数据,那么分析得出的结论也可能是垃圾结论。
“比如题库类产品,一道题可能需要20多个指标来分辨学生各方面的情况,如区域、学科、难度、知识点等等,如果试题质量比较低,区分度比较低,那做大数据分析的意义就不会太大。此外,现在的大数据分析多集中在选择、判断等客观题,对带有步骤的主观题、作文等进行统计分析则有更高难度。”因此,题库的大数据分析看起来比较简单,但实际上技术、资金门槛都比较高。
业内点评
“习”比“学”更易采集和分析
那么,教育大数据可以发挥怎样的作用呢?大数据研究专家、上海海事大学经济管理学院副教授魏忠认为,大数据技术的应用将有利于个性化教育,标准化的学习内容由学生自己组织学习,学校和教师更多的是关注学生的个性化培养,教师由教学者逐渐转变为助学者。
“重要的是数据背后的那个人。”微课网副总裁夏明瑞以历史学科视频课程为例,如果用户观看几分钟就关掉了,以后再没看过,那就要关注用户的这种行为数据。他关掉的原因大致可能有两种:一种是学得非常好,另一种是学得不好,看不懂。单节课的数据可能不够精准,但对整个课程体系的数据进行统计分析之后就会相对精准了。
杜昶旭则认为,目前“学”的过程采集数据的难度较大,“习”的过程采集和分析数据会相对容易一些。“今年我们推出了能力图谱,通过对学生行为数据进行诊断,看看学生的问题到底在哪里,然后基于能力缺陷推送需要完成的训练任务,提高学生学习效率。”杜昶旭说,这种大数据分析既能帮助学生个性化学习,也能帮助老师进行个性化教学。
专家说法
大数据适应个性化学习
魏忠,数据研究专家、上海海事大学经济管理学院副教授魏忠
人们对大数据的理解有很多,目前我倾向于把大数据理解为全量数据。
科学研究最简单的是抽样方式,然后进行推导,后来人们发现这有很大问题,于是就有了统计学,用概率来解决问题。但是抽样的量一旦到了一定程度之后,并不一定是越大越精准,什么样的量是最好的,就需要考量。而如果把全量的数据都拿来进行分析,那肯定是最准确的,而所谓大数据应该是全量数据。
这种大数据与传统的数据相比,具有非结构化、分布式、数据量巨大、数据分析由专家层变化为用户层、大量采用可视化展现方法等特点,这些特点正好适应了个性化和人性化的学习变化。传统数据诠释的是宏观的教育状况、整体的学生水平,且其采集方法、内容归类、分析构成等已被摸索出一套成熟的标准,数据更多是在阶段性的评估中获得。而大数据更关注微观、个体层面,要求时时处处采集信息,全面客观记录信息,大量采用可视化展现方法等等,帮助信息收集方获取精准材料。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
【核心关键词】软件、洞察力、大数据、产品、经验、硬件、流量、创新、决策、数据安全、网络安全、数据分析、决策制定、数据挖 ...
2026-06-18在方案选型、效果复盘、产品评估、供应商筛选等各类业务决策场景中,仅凭单一指标下结论往往会陷入 “以偏概全” 的误区。多维度 ...
2026-06-18 很多数据分析师精通Excel单元格操作,但当被问到“表结构数据的基本处理单位是什么”“字段和记录的本质区别”“为什么表结 ...
2026-06-18在数据分析、用户运营与业务增长的工作体系中,漏斗拆解是最基础也最高频的问题定位方法。很多业务场景下,我们只能看到最终的转 ...
2026-06-17在数据库开发、数据清洗与报表统计场景中,数值类型转换为日期是高频刚需操作。业务系统常以 Unix 时间戳、整型日期(如20240617 ...
2026-06-17 数据分析师八成以上的时间在和数据表格打交道,但许多人拿到Excel后习惯性地先算、先分析,结果回头发现漏了一列关键数据, ...
2026-06-17【核心关键词】数据库、电商、知识、产品、数据产品、监管业务、产品经理、业务系统、用户行为分析、用户分析、数据分析、电商 ...
2026-06-16在 Python 动态类型与面向对象的编程体系中,变量定义与类实例化是构建代码逻辑的两大核心基石。变量是数据存储、传递与运算的基 ...
2026-06-16 很多数据分析师每天与Excel打交道,但当被问到“表格结构数据和表结构数据有什么区别”“数据类型误判会引发哪些分析错误” ...
2026-06-16在 MySQL 查询性能优化体系中,索引是降低查询耗时、提升数据库吞吐的核心手段。其中联合索引与覆盖索引是实际开发中最高频的两 ...
2026-06-15在数据仓库建设与商业智能分析体系中,维度建模是应用最广泛的建模方法论,而事实表与维度表是维度建模的两大核心构件,共同构成 ...
2026-06-15 很多数据分析师能熟练计算指标,但当被问到“这家企业的核心业务目标是什么”“如何把模糊的战略目标拆解为可量化的指标”“ ...
2026-06-15在数据分析、业务监控、运营复盘等场景中,列值趋势计算是核心需求之一。无论是分析销售额的月度增长、用户活跃的变化趋势、库存 ...
2026-06-12在数字经济深度渗透的当下,消费者的购买行为已从过去的 “被动接受” 转变为 “主动决策”。流量红利消退、获客成本攀升、用户 ...
2026-06-12CDA三级认证是三个级别中的塔尖,全面考察数据战略、团队领导和复杂项目的综合能力。它所对应的《敏捷数据挖掘》教材,不再局限 ...
2026-06-12在游戏产业的商业逻辑中,付费玩家是支撑游戏生存与发展的核心支柱。行业普遍遵循 “二八定律”:20% 的付费玩家贡献了游戏 80% ...
2026-06-11【核心关键词】企业、定位、传统、产品、互联网、可视化、业务侧、数字化、结构化、数据分析、传统制造业、市场状态、发展空间 ...
2026-06-11 解读《CDA二级教材:量化策略分析(2025)》的全景结构与学习逻辑 ” CDA二级认证是企业招聘数据分析师时最常提及的证书门槛 ...
2026-06-11【核心关键词】药企、可视化、营销、分类、数据分析师、销售数据、业务人员、指导方向、分析报告、营销数据、营销医生 【专访摘 ...
2026-06-10在统计学分析、问卷调研、实验验证、业务复盘等场景中,卡方检验与 T 检验是应用最广泛的两类基础假设检验方法。前者专门处理分 ...
2026-06-10