京公网安备 11010802034615号
经营许可证编号:京B2-20210330
以解决问题的姿态玩大数据_数据分析师考试
著名管理咨询公司麦肯锡声称:“数据已经渗透到当今每一个行业和业务职能领域,成为重要的生产因素。人们对于大数据的挖掘和运用,预示着新一波生产力增长和消费者盈余浪潮的到来。”由此引发了大数据的热潮,美国政府2012年宣布投资2亿美元启动“大数据研究和发展计划”,IBM,微软、谷歌、亚马逊等大型企业纷纷投入。中国政府紧接着提出“十二五国家政务信息化建设工程规划”,北京、上海、广东等地陆续推出大数据研发战略,阿里、百度、腾迅、华为等大型企业都已涉足该领域,更有许多新兴企业致力于此,大数据成为了继物联网、云计算、移动互联网之后,又一个信息技术产业发展的制高点!
所谓大数据,必须有足够大的数据量才能发挥它的价值。但是,由于现阶段互联网数据真实性的问题,物联网数据量不够的问题,以及数据安全的问题,对大数据走向应用产生了较大束缚,以至于大部分大数据应用只能存在于“实验室中”,且大数据厂商开始纠结单点上的数据精度,单这一点便是有悖于大数据发展常规的。
在如此现状之下,罗克佳华——这家有着计算机系统集成一级资质,属“应用基因”系的企业涉足大数据,是否能够独善其身,让大数据概念回归本位呢?且看罗克佳华董事长李玮在接受本刊专访时的“如是说”。
我们不是实验室
“罗克佳华做大数据,从不追求一个点的精度,我又不是实验室!我要通过广泛布点的方式获取更多的数据,找到源头,提供解决问题的依据,也就是说,罗克佳华从来不做实验室里的大数据,只从解决问题的角度做可用的大数据。”李玮一句话,态度明确:我——罗克佳华做的所有工作都是以解决问题为目的,以应用为宗旨。
李玮说,首先罗克佳华是一家标准的物联网企业,因此就要做物联网企业该做的事。那么,物联网企业该做什么呢?“我们认为,物联网的规模性必定导致集中的数据服务,也就是说物联网的大量感知终端将产生前所未有的集中的数据量,而这些集中数据通过各种算法,依据各种需求,将延伸出无以数计的服务,这些服务才是物联网的真正价值所在。”而罗克佳华这些年,不管是卖设备,还是卖解决方案,都没落下一件事,就是提供服务。因此,在物联网时代,依据物联网发展线路图,罗克佳华将自己的发展布局做了更为清晰的调整:走云+端之路,“云+端的意思,就是物联网技术和数据服务的结合”。
如何提供更好的服务,罗克佳华也并非一开始就找到了门路。比如在环保监测方面,也做了多种尝试,比如先是重视监测,后来才发现“点多面广的综合监测”得到的效果更好,便将轻监测、广布点的模式推广到其他诸如农业溯源、煤矿安全等领域中。
例如罗克佳华为北京通州做的环保物联网系统,将所有的环保信息化系统进行整合,并结合大家关注的空气质量问题,在全区范围布设了 500个监测点,进行物联网监测,同时将各个工业污染源、农村面源、汽车尾气等导致空气质量变化的排放清单进行实时分析,不仅做到了物联网监测,也充分发挥了数据分析优势,实现了对空气质量的预警预报,以及对环保工作的综合优化管理。
愿景VS红线
至此,罗克佳华的“智能端”和“云服务”形成了一种相辅相成的促进作用,计划在几年内成为节能、环保领域内最强的物联网服务型企业。但成功之路必有坎坷,云+端模式要发展有一个非常重要的基础条件,即政府和行业对数据质量、价值、权益、隐私、安全等产生充分认识,出台量化与保障措施。也就是“数据权属”和“企业观念”两个问题。而正如前文所言,中国目前仍处在大数据的起步阶段,相关立法颇多空白,国内企业的意识也有待转变。
罗克佳华的服务方式是通过监测系统获得真实有效的数据进行分析,可几乎所有用户都在系统布设之后谈及数据保密问题,对项目产生了巨大的干扰。更有甚者,罗克佳华曾试图将一些污染源数据向同行的企业开放,便于他们在对比中提高自己,但这些隐去了名字的数据在不久后就被企业告了状,最后由政府出面叫停。
“物联网数据经常会触到红线,数据运营,如履薄冰啊!”李玮直言数据权属问题是挡在他们身前的“拦路虎”,更是他们将来必须解决的核心问题。不说罗克佳华有许多政府合作项目,导致权属问题更加复杂,光是环境数据及工业设备信号等公共数据如何界定、如何共享都已是非常纠结的问题。
不过,虽然有这方面的忧虑,但毕竟前路漫漫,还有许多未知数,罗克佳华在行动上并没有丝毫的犹豫。本着应用为先的原则,只要是有利于推广和应用的项目,不管是政府买单或是市场化,他们都会积极去做。为了拿出更加专业的精品,他们更以开放的姿态寻求跨界的合作企业和专家团队。“我们做技术的,做好技术,社会要发展,体制待改善,机会就有的。物联网数据要和同行业开放才会更有活力和竞争力,开放的意识形态才会造就开放的国家。”
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在数据驱动决策的浪潮中,数据挖掘与数据分析是两个高频出现且极易被混淆的概念。有人将二者等同看待,认为“做数据分析就是做数 ...
2026-04-01在数据驱动决策的时代,企业与从业者每天都会面对海量数据——电商平台的用户行为数据、金融机构的信贷风险数据、快消品牌的营销 ...
2026-04-01在数字化转型的浪潮中,企业数据已从“辅助运营的附属资源”升级为“驱动增长的核心资产”,而一套科学、可落地的企业数据管理方 ...
2026-04-01在数字化时代,每一位用户与产品的交互都会留下可追溯的行为轨迹——电商用户的浏览、加购、下单,APP用户的注册、登录、功能使 ...
2026-03-31在日常数据统计、市场调研、学术分析等场景中,我们常常需要判断两个分类变量之间是否存在关联(如性别与消费偏好、产品类型与满 ...
2026-03-31在CDA(Certified Data Analyst)数据分析师的职场实战与认证考核中,“可解释性建模”是核心需求之一——企业决策中,不仅需要 ...
2026-03-31多层感知机(MLP,Multilayer Perceptron)作为深度学习中最基础、最经典的神经网络模型,其结构设计直接决定了模型的拟合能力、 ...
2026-03-30在TensorFlow深度学习实战中,数据集的加载与预处理是基础且关键的第一步。手动下载、解压、解析数据集不仅耗时费力,还容易出现 ...
2026-03-30在CDA(Certified Data Analyst)数据分析师的日常工作中,“无监督分组、挖掘数据内在聚类规律”是高频核心需求——电商场景中 ...
2026-03-30机器学习的本质,是让模型通过对数据的学习,自主挖掘规律、实现预测与决策,而这一过程的核心驱动力,并非单一参数的独立作用, ...
2026-03-27在SQL Server数据库操作中,日期时间处理是高频核心需求——无论是报表统计中的日期格式化、数据筛选时的日期类型匹配,还是业务 ...
2026-03-27在CDA(Certified Data Analyst)数据分析师的能力体系与职场实操中,高维数据处理是高频且核心的痛点——随着业务场景的复杂化 ...
2026-03-27在机器学习建模与数据分析实战中,特征维度爆炸、冗余信息干扰、模型泛化能力差是高频痛点。面对用户画像、企业经营、医疗检测、 ...
2026-03-26在这个数据无处不在的时代,数据分析能力已不再是数据从业者的专属技能,而是成为了职场人、管理者、创业者乃至个人发展的核心竞 ...
2026-03-26在CDA(Certified Data Analyst)数据分析师的能力体系中,线性回归是连接描述性统计与预测性分析的关键桥梁,也是CDA二级认证的 ...
2026-03-26在数据分析、市场研究、用户画像构建、学术研究等场景中,我们常常会遇到多维度、多指标的数据难题:比如调研用户消费行为时,收 ...
2026-03-25在流量红利见顶、获客成本持续攀升的当下,营销正从“广撒网”的经验主义,转向“精耕细作”的数据驱动主义。数据不再是营销的辅 ...
2026-03-25在CDA(Certified Data Analyst)数据分析师的全流程工作中,无论是前期的数据探索、影响因素排查,还是中期的特征筛选、模型搭 ...
2026-03-25在当下数据驱动决策的职场环境中,A/B测试早已成为互联网产品、运营、营销乃至产品迭代优化的核心手段,小到一个按钮的颜色、文 ...
2026-03-24在统计学数据分析中,尤其是分类数据的分析场景里,卡方检验和显著性检验是两个高频出现的概念,很多初学者甚至有一定统计基础的 ...
2026-03-24