京公网安备 11010802034615号
经营许可证编号:京B2-20210330
中移动掘金大数据 浪潮为其改造基础架构
海量数据是4G时代送给电信运营商最大的礼物。信息、互联网行为数据、话单数据、WAP日志/WEB日志、互联网网页、投诉文本、短信文本等结构化数据以及非结构数据呈现几何式增长,基于这些数据的挖掘、共享、分析已经成为全球电信运营商转变商业模式的重要资源,目前,全球120家运营商中,已经有48%的企业正在实施大数据战略。
某省移动公司是全省唯一专注移动通信领域的电信运营企业,网络容量1400万户,客户总量超过6000万户。作为“中国移动通信”网络的有机组成部分,该移动公司一直专注于新技术开发和应用,并在大数据平台的建设中走在了最前沿。
要用大数据 先改变基础架构
现阶段,三大运营商还处于数据应用的初级阶段只支持流量经营、智能管道等应用,主要采用基于内部整合数据的分析挖掘手段,未能形成规模并进行商业利用。而旧有系统建设分散,无法实现资源应用共享。数据的分散存储和传统架构的缺陷,无法满足新业务发展要求。
目前国内的三大运营商都在着力整合企业内外部数据,做到内部交易数据与互联网交互数据的融合,由此开展用户行为模式的分析与数据挖掘并支撑各类数据应用,包括:支持精细化营销、支持产品规划和创新、支持网络优化和投资、支持能力开放与合作。长远来看,运营商应建立基于大数据驱动,以消费者为中心、以客户体验为重心的企业运营及组织变革模式,如淘宝将数据化运营贯穿业务全过程,以选品、价格和推送作为淘宝客户体验的三个灵魂。
而现实的IT基础架构则阻碍了电信行业发展大数据的步伐。首先,传统IT系统建设分散,很难实现资源和应用共享。诸如经营分析、信令监测、综合网络分析、不良信息监测以及上网日志留存等大数据系统垂直建设较多,同时,系统建设存在重复建设、应用重复开发、各类专家资源无法共享等情况。
其次,数据分散存储,标准化程度低。要对网络流量大数据进行分析,必须实现数据的集中存储,并有统一的标准。但从目前来看,各大运营商数据系统的数据模型并未统一,跨系统综合分析较为困难,在原有基础之上实现统一管理的难度较高。
最后,以联机事务处理系统On-Line Transaction Processing (OLTP)为核心的传统架构难以满足新业务发展要求,海量的大数据处理需要高度易扩展、高性能的基础架构,先行架构在存储、计算等各个方面都不能满足需求。
架构改变是基础 整体效率是目标
为了推进全网数据流量的精细化经营,提升数据流量经营效益,尤其是挖掘数据价值,开拓新的业务内容和盈利项目,某省移动与浪潮合作搭建大数据平台,建成后该平台用于多个平台数据分析业务。平台会处理每月客户账单,确保每月1日按时为用户提供账单服务,河南移动每年数据符合增长率在15%左右,基础架构完全可以满足扩容的技术需求。
由50台浪潮双路服务器NF5270M3构建Hadoop平台是系统的核心,另外三十台NF5270M3构建数据库处理平台。
网络——容错,高性能
系统采用了全新的IP网络互联架构,有足够的容错能力和性能来支持规模化数据处理。这一设计方案的优点是每台服务器配置两个10GB端口,端口通过冗余绑定方式分别与两台不同的汇聚交换机相连。此外通过高度冗余的三台二层交换机将所有汇聚交换机连接为统一的子网,最大限度的提高系统的冗余度和节点间通信带宽限制。
存储——成本降20%,效率提高3倍
数据存储方案也采用了分布式本地存储方式,采用双路服务器构建,替代原有的MNC小型机加磁盘阵列的方式,建设成本降低了20%以上。新平台可实现海量图片、视频文件的快速存储与查询,数据处理效率提升50%以上。而且,浪潮根据该省移动数据具体需求对大数据系统做了深层次的优化,在存储和网络资源间更均匀地平衡负载,从而将资源利用率提高三倍多。
电信行业的大数据仍然刚刚起步
该移动完成大数据平台建设后,不仅可以为相关企业提供数据分析报告,增加新的企业赢利点,而且可以通过对用户位置信息和指令信息的历史数据和当前信息分析建模,服务公共服务业,指挥交通、应对突发事件和重大活动。
此外还可以对某个时段和某个地点的用户流量和关键影响因素进行分析,洞察结果可为零售商在新店设计和选址、商品促销方式等提供决策支撑,从而帮助零售商更好地洞察客户需求,提升营销业绩。
2014年大数据的普及和运用都达到了前所未有的高度,但仍然仅是一个起步。凭借数据分析来竞争,实现数据价值货币化,这是运营商的终极追求。当一个人拿着手机玩《刀塔传奇》时,用快的软件叫一辆出租车时,无形的数据已经形成了一个流通的气场,这个气场就需要运营山的大数据平台来支持,从这个角度看,运营商的大数据建设还有更远的路要走。
此次同该移动合作的浪潮是中国领先的云计算和大数据方案供应商,也是2014年唯一全面入围三大电信运营商的服务器品牌厂商,在运营商集采中占有30%的份额。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在数据科学的工具箱中,析因分析(Factor Analysis, FA)、聚类分析(Clustering Analysis)与主成分分析(Principal Component ...
2025-12-18自2017年《Attention Is All You Need》一文问世以来,Transformer模型凭借自注意力机制的强大建模能力,在NLP、CV、语音等领域 ...
2025-12-18在CDA(Certified Data Analyst)数据分析师的时间序列分析工作中,常面临这样的困惑:某电商平台月度销售额增长20%,但增长是来 ...
2025-12-18在机器学习实践中,“超小数据集”(通常指样本量从几十到几百,远小于模型参数规模)是绕不开的场景——医疗领域的罕见病数据、 ...
2025-12-17数据仓库作为企业决策分析的“数据中枢”,其价值完全依赖于数据质量——若输入的是缺失、重复、不一致的“脏数据”,后续的建模 ...
2025-12-17在CDA(Certified Data Analyst)数据分析师的日常工作中,“随时间变化的数据”无处不在——零售企业的每日销售额、互联网平台 ...
2025-12-17在休闲游戏的运营体系中,次日留存率是当之无愧的“生死线”——它不仅是衡量产品核心吸引力的首个关键指标,更直接决定了后续LT ...
2025-12-16在数字化转型浪潮中,“以用户为中心”已成为企业的核心经营理念,而用户画像则是企业洞察用户、精准决策的“核心工具”。然而, ...
2025-12-16在零售行业从“流量争夺”转向“价值深耕”的演进中,塔吉特百货(Target)以两场标志性实践树立了行业标杆——2000年后的孕妇精 ...
2025-12-15在统计学领域,二项分布与卡方检验是两个高频出现的概念,二者都常用于处理离散数据,因此常被初学者混淆。但本质上,二项分布是 ...
2025-12-15在CDA(Certified Data Analyst)数据分析师的工作链路中,“标签加工”是连接原始数据与业务应用的关键环节。企业积累的用户行 ...
2025-12-15在Python开发中,HTTP请求是与外部服务交互的核心场景——调用第三方API、对接微服务、爬取数据等都离不开它。虽然requests库已 ...
2025-12-12在数据驱动决策中,“数据波动大不大”是高频问题——零售店长关心日销售额是否稳定,工厂管理者关注产品尺寸偏差是否可控,基金 ...
2025-12-12在CDA(Certified Data Analyst)数据分析师的能力矩阵中,数据查询语言(SQL)是贯穿工作全流程的“核心工具”。无论是从数据库 ...
2025-12-12很多小伙伴都在问CDA考试的问题,以下是结合 2025 年最新政策与行业动态更新的 CDA 数据分析师认证考试 Q&A,覆盖考试内容、报考 ...
2025-12-11在Excel数据可视化中,柱形图因直观展示数据差异的优势被广泛使用,而背景色设置绝非简单的“换颜色”——合理的背景色能突出核 ...
2025-12-11在科研实验、商业分析或医学研究中,我们常需要判断“两组数据的差异是真实存在,还是偶然波动”——比如“新降压药的效果是否优 ...
2025-12-11在CDA(Certified Data Analyst)数据分析师的工作体系中,数据库就像“数据仓库的核心骨架”——所有业务数据的存储、组织与提 ...
2025-12-11在神经网络模型搭建中,“最后一层是否添加激活函数”是新手常困惑的关键问题——有人照搬中间层的ReLU激活,导致回归任务输出异 ...
2025-12-05在机器学习落地过程中,“模型准确率高但不可解释”“面对数据噪声就失效”是两大核心痛点——金融风控模型若无法解释决策依据, ...
2025-12-05