京公网安备 11010802034615号
经营许可证编号:京B2-20210330
以解决问题的姿态玩大数据_数据分析师
2011年,著名管理咨询公司麦肯锡声称:“数据已经渗透到当今每一个行业和业务职能领域,成为重要的生产因素。人们对于大数据的挖掘和运用,预示着新一波生产力增长和消费者盈余浪潮的到来。”由此引发了大数据的热潮,美国政府2012年宣布投资2亿美元启动“大数据研究和发展计划”,IBM,微软、谷歌、亚马逊等大型企业纷纷投入。中国政府紧接着提出“十二五国家政务信息化建设工程规划”,北京、上海、广东等地陆续推出大数据研发战略,阿里、百度、腾迅、华为等大型企业都已涉足该领域,更有许多新兴企业致力于此,大数据成为了继物联网、云计算、移动互联网之后,又一个信息技术产业发展的制高点!
所谓大数据,必须有足够大的数据量才能发挥它的价值。但是,由于现阶段互联网数据真实性的问题,物联网数据量不够的问题,以及数据安全的问题,对大数据走向应用产生了较大束缚,以至于大部分大数据应用只能存在于“实验室中”,且大数据厂商开始纠结单点上的数据精度,单这一点便是有悖于大数据发展常规的。
在如此现状之下,罗克佳华—这家有着计算机系统集成一级资质,属“应用基因”系的企业涉足大数据,是否能够独善其身,让大数据概念回归本位呢?且看罗克佳华董事长李玮在接受本刊专访时的“如是说”。
我们不是实验室
“罗克佳华做大数据,从不追求一个点的精度,我又不是实验室!我要通过广泛布点的方式获取更多的数据,找到源头,提供解决问题的依据,也就是说,罗克佳华从来不做实验室里的大数据,只从解决问题的角度做可用的大数据。”李玮一句话,态度明确:我—罗克佳华做的所有工作都是以解决问题为目的,以应用为宗旨。
李玮说,首先罗克佳华是一家标准的物联网企业,因此就要做物联网企业该做的事。那么,物联网企业该做什么呢?“我们认为,物联网的规模性必定导致集中的数据服务,也就是说物联网的大量感知终端将产生前所未有的集中的数据量,而这些集中数据通过各种算法,依据各种需求,将延伸出无以数计的服务,这些服务才是物联网的真正价值所在。”而罗克佳华这些年,不管是卖设备,还是卖解决方案,都没落下一件事,就是提供服务。因此,在物联网时代,依据物联网发展线路图,罗克佳华将自己的发展布局做了更为清晰的调整:走云+端之路,“云+端的意思,就是物联网技术和数据服务的结合”。
如何提供更好的服务,罗克佳华也并非一开始就找到了门路。比如在环保监测方面,也做了多种尝试,比如先是重视监测,后来才发现“点多面广的综合监测”得到的效果更好,便将轻监测、广布点的模式推广到其他诸如农业溯源、煤矿安全等领域中。
例如罗克佳华为北京通州做的环保物联网系统,将所有的环保信息化系统进行整合,并结合大家关注的空气质量问题,在全区范围布设了 500个监测点,进行物联网监测,同时将各个工业污染源、农村面源、汽车尾气等导致空气质量变化的排放清单进行实时分析,不仅做到了物联网监测,也充分发挥了数据分析优势,实现了对空气质量的预警预报,以及对环保工作的综合优化管理。
愿景VS红线
至此,罗克佳华的“智能端”和“云服务”形成了一种相辅相成的促进作用,计划在几年内成为节能、环保领域内最强的物联网服务型企业。但成功之路必有坎坷,云+端模式要发展有一个非常重要的基础条件,即政府和行业对数据质量、价值、权益、隐私、安全等产生充分认识,出台量化与保障措施。也就是“数据权属”和“企业观念”两个问题。而正如前文所言,中国目前仍处在大数据的起步阶段,相关立法颇多空白,国内企业的意识也有待转变。
罗克佳华的服务方式是通过监测系统获得真实有效的数据进行分析,可几乎所有用户都在系统布设之后谈及数据保密问题,对项目产生了巨大的干扰。更有甚者,罗克佳华曾试图将一些污染源数据向同行的企业开放,便于他们在对比中提高自己,但这些隐去了名字的数据在不久后就被企业告了状,最后由政府出面叫停。
“物联网数据经常会触到红线,数据运营,如履薄冰啊!”李玮直言数据权属问题是挡在他们身前的“拦路虎”,更是他们将来必须解决的核心问题。不说罗克佳华有许多政府合作项目,导致权属问题更加复杂,光是环境数据及工业设备信号等公共数据如何界定、如何共享都已是非常纠结的问题。
不过,虽然有这方面的忧虑,但毕竟前路漫漫,还有许多未知数,罗克佳华在行动上并没有丝毫的犹豫。本着应用为先的原则,只要是有利于推广和应用的项目,不管是政府买单或是市场化,他们都会积极去做。为了拿出更加专业的精品,他们更以开放的姿态寻求跨界的合作企业和专家团队。“我们做技术的,做好技术,社会要发展,体制待改善,机会就有的。物联网数据要和同行业开放才会更有活力和竞争力,开放的意识形态才会造就开放的国家。”
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
平均数是数据分析、数理统计与日常运算中最基础、最常用的统计量,核心作用是浓缩一组数据的整体水平、刻画数据集中趋势。在众多 ...
2026-08-24在MySQL数据库中,InnoDB存储引擎作为主流事务型引擎,默认事务隔离级别为可重复读(Repeatable Read,RR),这与SQL Server、Or ...
2026-08-24 很多数据分析师拿到数据就开始清洗、建模,但当被问到“这批数据属于什么类型——结构化还是非结构化?分类变量还是数值变量 ...
2026-08-24 很多数据分析师画过趋势图、做过业绩预测,但当被问到“这个月销售额增长20%,到底是长期趋势自然增长,还是促销活动的短期 ...
2026-08-21在数据分析与数据可视化工作中,直方图是展示数据分布特征、离散程度、集中区间的核心图表,能够直观呈现数值数据的频次分布规律 ...
2026-08-20在数据分析领域有一句核心准则:垃圾数据进,垃圾数据出。数据清洗是数据分析、数据建模、数据可视化之前的必经前置工序,也是保 ...
2026-08-20 很多数据分析师做过按月份的销售额趋势图,画过按天的流量折线图,但当被问到“时间序列和普通数据有什么本质区别”“季节性 ...
2026-08-20在Python数据分析与数据清洗工作中,Pandas是最核心的数据处理库,DataFrame是结构化数据的标准存储格式。在实时数据采集、循环 ...
2026-08-19在零售行业大数据分析与精细化运营领域,纸尿裤旁摆放啤酒是最经典、最具代表性的商业案例。两种看似毫无关联的商品,一个是婴幼 ...
2026-08-19 很多数据分析师能熟练地计算指标、搭建标签体系,但当被问到“画像到底在解决什么问题”“画像和标签是什么关系”“画像如何 ...
2026-08-19在数据分析、业务监控、质量检测与风险管控工作中,数据波动性是衡量数据稳定性、业务健康度、结果可信度的核心依据。数据波动代 ...
2026-08-18很多分析师在设计标签时思路清晰,但真到落地环节却面临“数据在手,不知如何转化为可用标签”的困境:或因加工方式选择不当导致 ...
2026-08-18在数据分析、业务评价、产品评级、用户分层与综合决策场景中,单一指标往往无法全面、客观地评价事物整体水平。现实中的评价对象 ...
2026-08-18在数理统计、假设检验、数据分析与机器学习领域中,卡方分布(χ²分布)是继正态分布、t分布之后最重要的连续型概率分布之一。 ...
2026-08-17在Python数据清洗、文本校验、账号密码规则校验、脏数据过滤、字符串规整化处理中,正则表达式是最高效、最常用的文本匹配工具。 ...
2026-08-17 很多分析师每天和数据打交道,但当被问到“标签是什么”“标签和指标有什么区别”“标签体系如何设计”时,却常常答不上来。 ...
2026-08-17手游行业具备用户迭代快、竞争激烈、用户粘性易流失的典型特征。随着新游持续上线、玩家审美升级、玩法疲劳等问题出现,存量用户 ...
2026-08-14在数字化产品运营、商业数据分析、业务增长管理中,零散的指标统计无法支撑系统性的业务决策。单一的点击率、转化率、销量数据只 ...
2026-08-14 很多数据分析师每天都在写SQL,但当被问到“数据查询语言(DQL)的本质是什么”“SELECT语句中各子句的书写顺序与实际执行顺 ...
2026-08-14在数据库数据分析、数据清洗、报表统计与业务查询场景中,日期时间是最高频、最核心的基础字段。数据库中存储的日期格式多样,包 ...
2026-08-13