京公网安备 11010802034615号
经营许可证编号:京B2-20210330
基于数据仓库的电子商务智能化发展及对策分析
近几年,中国网购发展迅猛,已成为中国消费市场的重要力量。足不出户就可以享受方便快捷、品种多样的购物特点吸引了越来越多的消费者融入网购行列。据据互联网咨询机构易观国际统计,2010年上半年中国网上零售市场交易规模达2133亿元,已接近商务部发布的2009年全年的2586亿元。2007年至2009年中国网络零售交易额年均增长速度达117%,约是同期社会消费品零售总额年均增长速度的6.5倍。仅2010年,B2C电子商务的网上零售市场规模突破1000亿元大关,达到1040亿元,环比增长373%。截止到2010年10月,我国的网购人数已达到1.42亿,网络上商品量已经达到数十亿件之多。如何在海量的客户和海量商品之间找到结合点,达成有效电子交易,促进电子商务平台竞争力提升,已经成为新时期网络购物,电子商务平台必须重视的重要问题。要从海量的数据中寻找决策,离不开先进的数据仓库技术。
1数据仓库的源起及作用
数据仓库之父William H.Inmon在1991年出版的。“Building the Data Warehouse”一书中所提出数据仓库(Data Warehouse)是一个面向主题的、集成的、随时间变化的,但信息本身相对稳定的,反映历史变化的数据集合。现在,数据仓库主要用于支持管理决策的结构化数据环境,并陆继出现了在数据仓库基础上进行联机分析处理技术OLAP分析、数据挖掘等传统的数据分析模式以及面向中小企业的数据分析代理应用模式。随着这些支撑商务智能技术的深入发展和应用,市场主流的电子商务网站已经可以实现自动记录客户的点击顺序,以及在每个产品停留的时间和成功的交易,进而分析用户的喜好,了解客户的潜在购买需求,并以此为关联,从海量商品中推荐符合客户购买习惯的精品商品,从而提供更好的服务并创造更多的利润。这仅仅是建立在网购用户层面的体验,基于数据仓库和多维分析技术的决策支持系统在企业营销库存管理中也充分发挥了——一分析顾客需求、了解市场行情、把握销售趋势、降低销售成本、实现合理库存的重要作用。
2 电子商务智能化发展中呈现的一些不足
虽然数据仓库在电子商务智能化的应用中发挥了积极的重要作用,但在实际的应用中还是存在许多不如人意的地方,主要反映在以下几个用户层面上:
2.1 网购消费者
网络购物平台对于每位消费者都是公共和平等的,以2010年第四季度以来我国主要B2C电子商务平台的大规模网络促销为例,在促销环境下,有许多商品未经甄选和个性化关联就呈现在用户面前,在提高销售量的同时,也产生了大量的非理性消费,当网购用户经过一轮的疯狂购物以后,发现大部分商品并不是所须商品和理想中的商品时,潜在的用户流失风险就产生了。有不少的消费者开始不再同一家商铺重复购买商品,有的甚至终止了原先的购买计划,这种用户流失对企业的销售影响是长期的。
2.2 网络营销商和产品生产企业
区别于传统的数据库,数据仓库一个重要的功能是为企业提供决策。当用户在购买了一部分产品之后,哪些产品同时购买的几率比较高?哪些产品的重复购买几率比较高?哪些产品的有效购买率比较高?虽然类似“购物篮分析”的技术应用已经在大部分电子商务平台开展实施,但是不难发现,消费者在网络购物中遭遇断货、空仓的现象司空见惯,而销售业绩惨淡、无人问津的网店商铺也比比皆是。传统的信息与数据分析处理技术已经远不能满足企业在电子商务网站环境下的需求。为了取得良好销售业绩,对大量的现有数据进行有依据、有针对性的数据挖掘,从而确定目标客户群、拟定生产计划、制定销售方案,是确保网络销售的顺利进行、提升销售业绩、防止用户流失的必要准备工作,而个准备工作做得是否充分,将对网络营销商和产品生产企业起着非常关键重要的作用。[page] 2.3 电子商务平台提供商
据相关调查显示,大部分网购者更改购买习惯,特别是从一个电子商务供应商转向另一个供应商只是为了得到更好的服务及节省支出。作为网购消费者,希望在浩如烟海的东西找到自己要的东西,最好是能快速地找到或者是网站平台自动提供相关的商品供用户选择。然而目前的数据处理技术还不太成熟,其应用还有较大的局限性。例如,网购消费者在进行商品搜索时不能以图片为搜索条件对图示实物进行搜索。以数据挖掘技术为例,目前的数据挖掘工具只能处理一些数值型的结构化数据,无法对图形、图像、数学公式等数据形式进行挖掘操作。通过在线分析与数据挖掘技术查询和分析数据库和数据仓库结果,将成为网络销售成败的关键因素。而决策准确度的偏差,将降低企业与网络平台供应商之间的依赖程度。
3 提高电子商务智能化的对策
众所周之,运费是网购相比实地购物的额外支出,如果能在能同一家网铺买到计划购买的全部商品则可以减少不必要的运费支出,从而大大提高消费者的购买机率。就目前的网购实际而言,这点对于大多数中小型网店难以实现。如何使网络营销商和生产企业的投入与业绩比达到最优化,建议加强以下两方面的建设:
数据仓库的重要特征之一是“面向主题”,即数据仓库的结构是围绕主题的。以C2C电子商务平台的“某一商品的购买用户统计”为例,主题即为对该商品的“购买用户统计”,它由事实表和维表构成。其中存储了所有与该商品产生交易事件用户信息的事实表,包括厂该商品的实际购买用户总数、新增用户数、新减用户数(由于退货等因素最终未能成功的交易)、无效用户数(关闭或取消的交易),这些作为数据统计的事实数据,是进行各种数据分析的基础,也是分析主体的量化体现。而购买该商品用户的重要标识(如用户名、性别,年龄,教育程度,经济收入)、所在区域,信用度等信息记录则是该数据仓库的维表,是数据分析决策的角度。通过对海量数据的分析,商品的决策者就可以开展诸如什么地区购买用户多、什么年龄阶层购买潜力大等相关决策分析。本文建议在数据仓库中建立公共区域特征维表,以用户地理区域为例,假设:购买某一商品的用户大多数来自某一地区,则可以关联该地区的人文、气候、风俗、习惯等特征,分析潜在购买商品的机率,从而带动相关产品的销售。公共区域特征数据库的建立与关联,也可以作为电子商务平台为用户个性化推荐商品的首要参考。
3.2 重视动态点击流数据仓库的利用来提高准确性
点击流(clickstream)是网页服务器日志文件所记录的网站上每个用户的每一次点击。传统的静态点击流数据主要来源干存储在、Web服务器的日志文件,由于网络数据传输途径的特殊性,难免夹杂一些脏数据或噪声数据,使得Web日志中的数据缺乏精准确度,就需要对数据进行净化处理、用户识别和会话识别等预处理工作,而数据预处理本身就是一项巨大的工程。并且,需要IP地址和Cookie技术辅助支持的Web日志用户识别和会话识别工作在实际操作过程中常常会受终端用户的限制。动态点击流的出现很好地解决了预处理的难题,它以网页“会话”——session为单位,每一个session ID对应一个用户,将与该会话相关联的全部Web看作一次用户会话,并设置超时时间,避免无效停留时间的累计。通过记录用户在各商品页面的停留时间、是否产生购物行为等数据,构建动态点击流数据仓库维模型,以准确分析网购用户的消费行为,兴趣偏好,从而进一步优化网站的内容和产品销售种类。
4 结语
网络购物的出现正以越来越广泛的影响改变人们的购物习惯和生活方式,电子商务技术正朝着消费者个性化、购物智能化、检索人性化的发展方向不断探索、不断完善。在提高电子商务智能化技术的同时,必须加强对信息传输数据的安全性管理,以防止信息被非法获取从而导致用户隐私泄漏,进一步实现我国电子商务的健康可持续发展。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在数据可视化领域,单一图表往往难以承载多维度信息 —— 力导向图擅长展现节点间的关联结构与空间分布,却无法直观呈现 “流量 ...
2025-10-27这个问题问到了 Tableau 中两个核心行级函数的经典组合,理解它能帮你快速实现 “相对位置占比” 的分析需求。“index ()/size ( ...
2025-10-27对 CDA(Certified Data Analyst)数据分析师而言,“假设检验” 绝非 “套用统计公式的机械操作”,而是 “将模糊的业务猜想转 ...
2025-10-27在数字化运营中,“凭感觉做决策” 早已成为过去式 —— 运营指标作为业务增长的 “晴雨表” 与 “导航仪”,直接决定了运营动作 ...
2025-10-24在卷积神经网络(CNN)的训练中,“卷积层(Conv)后是否添加归一化(如 BN、LN)和激活函数(如 ReLU、GELU)” 是每个开发者都 ...
2025-10-24在数据决策链条中,“统计分析” 是挖掘数据规律的核心,“可视化” 是呈现规律的桥梁 ——CDA(Certified Data Analyst)数据分 ...
2025-10-24在 “神经网络与卡尔曼滤波融合” 的理论基础上,Python 凭借其丰富的科学计算库(NumPy、FilterPy)、深度学习框架(PyTorch、T ...
2025-10-23在工业控制、自动驾驶、机器人导航、气象预测等领域,“状态估计” 是核心任务 —— 即从含噪声的观测数据中,精准推断系统的真 ...
2025-10-23在数据分析全流程中,“数据清洗” 恰似烹饪前的食材处理:若食材(数据)腐烂变质、混杂异物(脏数据),即便拥有精湛的烹饪技 ...
2025-10-23在人工智能领域,“大模型” 已成为近年来的热点标签:从参数超 1750 亿的 GPT-3,到万亿级参数的 PaLM,再到多模态大模型 GPT-4 ...
2025-10-22在 MySQL 数据库的日常运维与开发中,“更新数据是否会影响读数据” 是一个高频疑问。这个问题的答案并非简单的 “是” 或 “否 ...
2025-10-22在企业数据分析中,“数据孤岛” 是制约分析深度的核心瓶颈 —— 用户数据散落在注册系统、APP 日志、客服记录中,订单数据分散 ...
2025-10-22在神经网络设计中,“隐藏层个数” 是决定模型能力的关键参数 —— 太少会导致 “欠拟合”(模型无法捕捉复杂数据规律,如用单隐 ...
2025-10-21在特征工程流程中,“单变量筛选” 是承上启下的关键步骤 —— 它通过分析单个特征与目标变量的关联强度,剔除无意义、冗余的特 ...
2025-10-21在数据分析全流程中,“数据读取” 常被误解为 “简单的文件打开”—— 双击 Excel、执行基础 SQL 查询即可完成。但对 CDA(Cert ...
2025-10-21在实际业务数据分析中,我们遇到的大多数数据并非理想的正态分布 —— 电商平台的用户消费金额(少数用户单次消费上万元,多数集 ...
2025-10-20在数字化交互中,用户的每一次操作 —— 从电商平台的 “浏览商品→加入购物车→查看评价→放弃下单”,到内容 APP 的 “点击短 ...
2025-10-20在数据分析的全流程中,“数据采集” 是最基础也最关键的环节 —— 如同烹饪前需备好新鲜食材,若采集的数据不完整、不准确或不 ...
2025-10-20在数据成为新时代“石油”的今天,几乎每个职场人都在焦虑: “为什么别人能用数据驱动决策、升职加薪,而我面对Excel表格却无从 ...
2025-10-18数据清洗是 “数据价值挖掘的前置关卡”—— 其核心目标是 “去除噪声、修正错误、规范格式”,但前提是不破坏数据的真实业务含 ...
2025-10-17