京公网安备 11010802034615号
经营许可证编号:京B2-20210330
大数据的商业应用_数据分析师
大数据(Big data)的浪潮正在席卷神州大地,但企业对如何落地仍然狐疑。2013年8月6日,Splunk公司在北京举办了一场“大数据如何落地研讨会”,为大数据技术在中国企业的落地带来了诸多的前沿观点、可以参考的实施路径以及丰富的案例。
大数据需求强劲
在当前全球经济形势下行的背景下,中国的经济形势也不甚乐观,但正因为如此,中国企业对挖掘大数据价值的渴求尤为强烈,希望以此提高客户体验,促进业务的增长。根据国内市场研究机构计世资讯的研究,2012年中国大数据市场增长率为52.4%,市场规模达到3.2亿元。55%的受访企业表示,计划在未来一年内部署大数据应用。
随着大数据的发展,其应用场景也越来越多,涵盖从用户行为分析到安全监控、舆情监测等等各方面,计世资讯计算机系统研究部总监丁震表示,用户不仅利用大数据获取更大的数据价值,还利用它整合内部的工作流程,提高效率和可控性。
计世资讯计算机系统研究部总监丁震
在发展的过程中,大数据的需求已经从早期的互联网、电商领域转向金融、电信、政府、能源等诸多传统的行业。尽管用户认为大数据能够提高决策和数据分析的及时性,但丁震指出,用户实际应用仍十分谨慎,这其中有用户认识、案例缺乏、引入新技术的风险和经济环境等原因。
大数据价值:从机器数据开始
针对中国用户的上述困扰,Splunk带来了一个完整的解决方案。与一些BI(商业智能)、数据仓库和数据挖掘厂商的新解决方案着眼点不一样,Splunk产品营销副总裁Sanjay Mehta认为,大数据的落地,可以从机器数据着手,通过Splunk实时的“引擎”,将已有的数据组织起来,帮助企业提高效率,降低成本。
Sanjay Mehta负责开发与规划Splunk以重点市场为目标的核心产品策略,并将该公司的业务重心引导到了面向大数据。当前不断扩展的数据源主要包括商业应用程序的数据、机器生成的数据和人为生成的数据,大多数从BI、数据挖掘升级的大数据产品,更多的是关注商业应用程序的数据和认为生成的数据,机器数据则往往被忽略,但Splunk注意到了这个层面。
Splunk产品营销副总裁Sanjay Mehta
Splunk定义的机器数据,包括了文件或者文件目录、syslog、Windows事件日志、Windows注册表、Windows性能指标、Unix/Linux日志和指标、文件完整性监视、配置文件、OPSEC LEA、Cisco设备日志、IIS日志、Apache日志、WebSphere日志/指标和其他数据、以及任何其他数据。
可以说,本来就存在的机器数据是一团乱糟糟,且不同种类的机器数据相互不能通气,发挥的作用非常有限,但通过整合的大数据技术,对机器数据的收集、存储、分析和展现,其结果在应用程序管理、IT运维管理、安全及合规、web情报、业务分析和行业数据等多个方面,都有广泛的应用价值。
Sanjay Mehta介绍了Splunk的一系列的案例,例如,帮助百事公司实现了实时运营可视化,百事公司销售人员使用Splunk手持终端了解销售状况,可以看到销售实时数据,以确保其销售工作的效果和效率,所有的数据来源都是通过基础架构而来,而非关系型数据库;帮助salesforce.com实现全商务领域运营情报,将问题解决率提高96%,为其10多万家客户提供更好的体验……
此外,Sanjay Mehta还分享了Splunk产品用于从电梯运行数据监控中获得预测信息、通过医疗设备更好地了解患者状况以及分析建筑物感应器,以降低能源成本等应用场景。
国内的上海天旦网络(Netis)和北京华夏威科软件技术有限公司的代表分别在现场介绍了Splunk大数据技术在不同行业的应用。
上海天旦介绍了Splunk在一个网上支付平台的运维管理工作的支持。华夏威科Splunk产品经理王文雅表示,在国内某大型银行,通过单一的Splunk平台,跨平台收集不同格式的日志,对每天20G的数据进行收集、管理、实时展示分析,以及建立关联、历史数据比对等等,大大提高了IT人员对企业环境的可见性。而这一切的工作,Splunk Index Server仅仅需要使用2台4个CPU、4G内存的虚拟机(VM)来支持。
当然,Splunk的案例还有很多。截至目前,Splunk的客户数量超过了5600家,分布在全球90多个国家。
其中,中移动、中电信、招行、交行、广发、联想、东航、支付宝和国美在线等是Splunk在中国地区的主要客户——同样覆盖了电信、金融、能源、互联网等多个行业。
凭借技术积累和服务经验,Splunk在大数据的浪潮到来之际,于2012年4月19日在纳斯达克成功上市,2013财年收益达到1989亿美元,年复合增长率为91%。此前,还曾传出IBM欲收购Splunk的传闻。
Splunk:技术保证效果
Splunk为何能够适用于如此广泛的应用场景?Splunk高级销售工程师崔玥为我们揭秘了Splunk产品背后的技术特色。
Splunk高级销售工程师崔玥
崔玥表示,Splunk的本质是一个针对机器数据的搜索引擎,针对所有IT系统和基础设施数据,提供数据搜索、数据报表和可视化的展现。当然,作为一款软件,它几分钟就可以完成下载和安装,支持各种主流的操作系统平台。
作为一个完全整合的大数据解决方案,Splunk通用的引擎能够将任何的机器数据广泛地索引,并支持任何格式的数据,而无需进行格式转换;实时的搜索引擎,带来了类似于Google的快速搜索结果;而其自主开发的类似于MapReduce的分布式架构,为系统的可扩展性提供了保证,能够轻松扩展到支持每天新增上百TB的数据,配合基于角色的数据访问控制,还能够跨多个数据中心运行。
由于架构设计的优势,Splunk在提供高可扩展性、易用性和广泛适用性的同时,对硬件的需求却几乎没有门槛,前述的银行案例可以证明。
值得一提的是,通过Splunk今年6月份发布的Hunk产品,组织机构还能够更快速、更简单地探索、分析、可视化和分享存储在Hadoop中的数据。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在用户行为分析实践中,很多从业者会陷入一个核心误区:过度关注“当前数据的分析结果”,却忽视了结果的“泛化能力”——即分析 ...
2026-03-13在数字经济时代,用户的每一次点击、浏览、停留、转化,都在传递着真实的需求信号。用户行为分析,本质上是通过收集、整理、挖掘 ...
2026-03-13在金融、零售、互联网等数据密集型行业,量化策略已成为企业挖掘商业价值、提升决策效率、控制经营风险的核心工具。而CDA(Certi ...
2026-03-13在机器学习建模体系中,随机森林作为集成学习的经典算法,凭借高精度、抗过拟合、适配多场景、可解释性强的核心优势,成为分类、 ...
2026-03-12在机器学习建模过程中,“哪些特征对预测结果影响最大?”“如何筛选核心特征、剔除冗余信息?”是从业者最常面临的核心问题。随 ...
2026-03-12在数字化转型深度渗透的今天,企业管理已从“经验驱动”全面转向“数据驱动”,数据思维成为企业高质量发展的核心竞争力,而CDA ...
2026-03-12在数字经济飞速发展的今天,数据分析已从“辅助工具”升级为“核心竞争力”,渗透到商业、科技、民生、金融等各个领域。无论是全 ...
2026-03-11上市公司财务报表是反映企业经营状况、盈利能力、偿债能力的核心数据载体,是投资者决策、研究者分析、从业者复盘的重要依据。16 ...
2026-03-11数字化浪潮下,数据已成为企业生存发展的核心资产,而数据思维,正是CDA(Certified Data Analyst)数据分析师解锁数据价值、赋 ...
2026-03-11线性回归是数据分析中最常用的预测与关联分析方法,广泛应用于销售额预测、风险评估、趋势分析等场景(如前文销售额预测中的多元 ...
2026-03-10在SQL Server安装与配置的实操中,“服务名无效”是最令初学者头疼的高频问题之一。无论是在命令行执行net start启动服务、通过S ...
2026-03-10在数据驱动业务的当下,CDA(Certified Data Analyst)数据分析师的核心价值,不仅在于解读数据,更在于搭建一套科学、可落地的 ...
2026-03-10在企业经营决策中,销售额预测是核心环节之一——无论是库存备货、营销预算制定、产能规划,还是战略布局,都需要基于精准的销售 ...
2026-03-09金融数据分析的核心价值,是通过挖掘数据规律、识别风险、捕捉机会,为投资决策、风险控制、业务优化提供精准支撑——而这一切的 ...
2026-03-09在数据驱动决策的时代,CDA(Certified Data Analyst)数据分析师的核心工作,是通过数据解读业务、支撑决策,而指标与指标体系 ...
2026-03-09在数据处理的全流程中,数据呈现与数据分析是两个紧密关联却截然不同的核心环节。无论是科研数据整理、企业业务复盘,还是日常数 ...
2026-03-06在数据分析、数据预处理场景中,dat文件是一种常见的二进制或文本格式数据文件,广泛应用于科研数据、工程数据、传感器数据等领 ...
2026-03-06在数据驱动决策的时代,CDA(Certified Data Analyst)数据分析师的核心价值,早已超越单纯的数据清洗与统计分析,而是通过数据 ...
2026-03-06在教学管理、培训数据统计、课程体系搭建等场景中,经常需要对课时数据进行排序并实现累加计算——比如,按课程章节排序,累加各 ...
2026-03-05在数据分析场景中,环比是衡量数据短期波动的核心指标——它通过对比“当前周期与上一个相邻周期”的数据,直观反映指标的月度、 ...
2026-03-05