京公网安备 11010802034615号
经营许可证编号:京B2-20210330
大数据怎么赚钱
6月初,菜鸟与顺丰互相指责对方关闭数据接口,这场关于数据的大战引发了各界关注。快递行业的巨头为何如此重视对数据的争夺?大数据市场有多大?大数据怎么赚钱?针对这些问题,经济日报·中国经济网记者采访了业内专家和企业。
大数据市场有多大
“大数据的市场规模没有天花板。”国务院发展研究中心信息中心研究处处长李广乾认为。不过细想,这正是目前各大企业和资本疯狂追逐大数据产业的重要原因。
“单独讨论大数据意义不大,它是依附于具体业务,和各个行业密切相关的。”李广乾认为,大数据产业规模和两大因素相关:一是经济发展水平,需要大数据的业务越多,市场体量就越大;二是信息化发展水平,能够产生数据的终端越多,数据就会越聚越多,而数据的生产是没有上限的。
目前,大数据的金矿还仅是开挖了“冰山一角”。全球来看,Gartner2016年最新的技术成熟度曲线显示,大数据作为新兴领域,已经进入应用发展阶段,基础设施建设带来的规模性高速增长出现逐步放缓的趋势,技术创新和商业模式创新推动各行业应用逐步成熟,应用创造的价值在市场规模中的比重日益增大,并成为新的增长动力。
从总体规模看,2016年,全球大数据市场规模实现16.5%的增长,预计将连续3年保持增速在15%左右。同时,大数据成为全球IT支出新的增长点,2016年,有近40%的企业正在实施和扩大大数据技术的应用,另有30%计划在未来12个月内应用大数据。
“说大数据产业是一张画得很大的饼显然是片面的。”工信部赛迪研究院软件所所长潘文预测,包括大数据硬件、大数据软件、大数据服务等在内的大数据核心产业环节,2016年达到3100亿元,将在2020年超过1万亿元;大数据关联产业规模2016年超过5万亿元,将在2020年超过10万亿元;大数据融合产业规模2016年达到3.5万亿元,将在2020年超过20万亿元。
“从大数据核心产业结构看,基于大数据的服务是大数据核心产业的主体,其规模约占大数据核心产业规模的90%,未来,服务也将是大数据产业的最核心部分。”潘文说。
做数据“搬运工”
目前国内大数据公司分为两类:一类是已有获取大数据能力的公司,如百度、腾讯、阿里巴巴等互联网巨头及华为、浪潮、中兴等企业,涵盖了数据采集、数据存储、数据分析、数据可视化及数据安全等领域;另一类则是初创大数据公司,依靠大数据工具,针对市场需求,为市场带来创新方案并推动技术发展。
不同的大数据公司,盈利模式也不相同。如果把大数据产业比作房地产开发,那么海量数据就是地产开发时的土地资源,数据挖掘开发就是地产搭建盖楼。大数据主要的盈利模式也是围绕这两方面展开,一是通过直接“搬运”数据赚钱,二是通过数据加工分析盈利。
“我们就像一个自来水厂一样,用户要你提供干净的自来水,对方可能是酒厂、饭店、饮料厂,他把你的水做成饮料或酒。”聚合数据就是一家主要依靠为客户提供数据盈利的公司,公司创始人左磊对其商业模式作了一个形象的比喻。
在开发APP应用过程中,左磊发现客户对于数据的需求非常大,但他们本身却没有能力去做这些事情。聚合数据的主营业务,就是整合市面上有价值的数据源,从车辆违章信息、航班火车查询、全国加油站实时油价,到在线试题、电影、股票,做成标准化的API(应用程序编程接口),开放给开发者、企业及微信公众号用户等使用,为他们免除数据收集、维护等环节。简言之,聚合数据是一家数据源公司,充当的是数据“搬运工”的角色。
在变现模式上,针对一些本身成本不高的服务,聚合数据会对用户实行免费,而对一些成本相对高的服务,会按照每个接口或服务的成本收取不同的费用。2016年,聚合数据光API接口一项营收就超过1000万元。
聚合数据的盈利模式是数据买卖市场一个有代表性的类型。另一个代表性类型是,国内乃至全球第一家大数据交易所——贵阳大数据交易所,自2015年4月正式挂牌运营以来,仅用两年多时间,就实现了可交易数据总量超过150PB,内容涵盖政府、金融、交通等30大类领域,并于今年上半年实现正现金流,预计今年底累计交易流水将突破2亿元人民币。
数据的“消化”和“利用”
如果说搬运数据是秀肌肉的“体力活”,那么分析数据并提供解决方案就是拼智商的“脑力活”,相当于把收集来的数据“消化”“利用”好。直接售卖数据是比较底层的盈利方式,而对数据进行处理加工则在商业模式上具备更多的想象空间。
数据分析可大致分为直接提供数据分析工具和输出解决方案两种模式。潘文说,数据分析工具通常可以实现情报挖掘、舆情分析、销售追踪、精准营销、个性化推荐、网站/APP分析等功能,收费方式采取按需购买,部分功能服务免费,部分功能服务收费。
阿里云的“数加”平台就是典型的数据工具盈利模式。阿里云大数据事业部总监徐常亮表示,阿里云“数加”平台,承载着阿里巴巴集团、蚂蚁金服的数据,可提供一站式的数据计算、加工、处理等服务,用户不用自建计算平台。此外,基于“数加”平台,阿里云还提供数十款应用工具,覆盖数据采集、计算引擎、数据加工、数据分析、机器学习、数据应用等数据生产全链条。
计算引擎之上,“数加”平台提供了最丰富的云端数据开发套件,包括数据集成、数据开发、调度系统、数据管理、运维视屏、数据质量、任务监控。在数据分析方面,通过移动数据分析产品,开发者可快速搭建日志采集、分析系统;通过“数加”平台BI报表产品,3分钟即可完成海量数据的分析报告。在机器学习方面,“数加”平台发布的机器学习工具,可基于海量数据实现对用户行为、行业走势、天气、交通等的预测。
大数据公司百分点的展厅内有一面弧形墙,可以24小时实时更新数据资料和图谱。这面墙上有全网当日产品销售统计和热销产品榜单,每一个产品都有详情介绍。百分点研发总监苏海波介绍,5.5亿用户的“画像”汇总于此,包括购物偏好、网购金额变化趋势、阅读兴趣等。用户的任何网上行为都会成为大数据的一部分,经过筛选加入到用户的数据中。通过与百分点合作,商户可以根据用户消费偏好,定向推送商品;旅行社可以定向推送旅游行程信息和报价;新闻资讯APP则可以推送用户感兴趣的信息。
在输出解决方案上,大数据还可以应用到医疗、教育、零售、通信等传统行业。通过大数据产生更多收益,节约成本,优化原有行业,衍生出新的商业模式。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在构建前向神经网络(Feedforward Neural Network,简称 FNN)时,“隐藏层数目设多少?每个隐藏层该放多少个神经元?” 是每个 ...
2025-10-29这个问题切中了 Excel 用户的常见困惑 —— 将 “数据可视化工具” 与 “数据挖掘算法” 的功能边界混淆。核心结论是:Excel 透 ...
2025-10-29在 CDA(Certified Data Analyst)数据分析师的工作中,“多组数据差异验证” 是高频需求 —— 例如 “3 家门店的销售额是否有显 ...
2025-10-29在数据分析中,“正态分布” 是许多统计方法(如 t 检验、方差分析、线性回归)的核心假设 —— 数据符合正态分布时,统计检验的 ...
2025-10-28箱线图(Box Plot)作为展示数据分布的核心统计图表,能直观呈现数据的中位数、四分位数、离散程度与异常值,是质量控制、实验分 ...
2025-10-28在 CDA(Certified Data Analyst)数据分析师的工作中,“分类变量关联分析” 是高频需求 —— 例如 “用户性别是否影响支付方式 ...
2025-10-28在数据可视化领域,单一图表往往难以承载多维度信息 —— 力导向图擅长展现节点间的关联结构与空间分布,却无法直观呈现 “流量 ...
2025-10-27这个问题问到了 Tableau 中两个核心行级函数的经典组合,理解它能帮你快速实现 “相对位置占比” 的分析需求。“index ()/size ( ...
2025-10-27对 CDA(Certified Data Analyst)数据分析师而言,“假设检验” 绝非 “套用统计公式的机械操作”,而是 “将模糊的业务猜想转 ...
2025-10-27在数字化运营中,“凭感觉做决策” 早已成为过去式 —— 运营指标作为业务增长的 “晴雨表” 与 “导航仪”,直接决定了运营动作 ...
2025-10-24在卷积神经网络(CNN)的训练中,“卷积层(Conv)后是否添加归一化(如 BN、LN)和激活函数(如 ReLU、GELU)” 是每个开发者都 ...
2025-10-24在数据决策链条中,“统计分析” 是挖掘数据规律的核心,“可视化” 是呈现规律的桥梁 ——CDA(Certified Data Analyst)数据分 ...
2025-10-24在 “神经网络与卡尔曼滤波融合” 的理论基础上,Python 凭借其丰富的科学计算库(NumPy、FilterPy)、深度学习框架(PyTorch、T ...
2025-10-23在工业控制、自动驾驶、机器人导航、气象预测等领域,“状态估计” 是核心任务 —— 即从含噪声的观测数据中,精准推断系统的真 ...
2025-10-23在数据分析全流程中,“数据清洗” 恰似烹饪前的食材处理:若食材(数据)腐烂变质、混杂异物(脏数据),即便拥有精湛的烹饪技 ...
2025-10-23在人工智能领域,“大模型” 已成为近年来的热点标签:从参数超 1750 亿的 GPT-3,到万亿级参数的 PaLM,再到多模态大模型 GPT-4 ...
2025-10-22在 MySQL 数据库的日常运维与开发中,“更新数据是否会影响读数据” 是一个高频疑问。这个问题的答案并非简单的 “是” 或 “否 ...
2025-10-22在企业数据分析中,“数据孤岛” 是制约分析深度的核心瓶颈 —— 用户数据散落在注册系统、APP 日志、客服记录中,订单数据分散 ...
2025-10-22在神经网络设计中,“隐藏层个数” 是决定模型能力的关键参数 —— 太少会导致 “欠拟合”(模型无法捕捉复杂数据规律,如用单隐 ...
2025-10-21在特征工程流程中,“单变量筛选” 是承上启下的关键步骤 —— 它通过分析单个特征与目标变量的关联强度,剔除无意义、冗余的特 ...
2025-10-21