京公网安备 11010802034615号
经营许可证编号:京B2-20210330
2014年12月12-14日,由中国计算机学会(CCF)主办,CCF大数据专家委员会承办,中科院计算所与CSDN共同协办的 2014中国大数据技术大会 将在北京新云南皇冠假日酒店拉开帷幕。大会为期三天,以推进行业应用中的大数据技术发展为主旨,拟设立“大数据基础设施”、“大数据生态系统”、“大数据技术”、“大数据应用”、“大数据互联网金融技术”、“智能信息处理”等多场主题论坛与行业峰会。由中国计算机学会主办,CCF大数据专家委员会承办,南京大学与复旦大学协办的“2014年第二届CCF大数据学术会议”也将同时召开,并与技术大会共享主题报告。
本次大会将邀请近100位国外大数据技术领域顶尖专家与一线实践者,深入讨论Hadoop、YARN、Spark、Tez、 HBase、Kafka、OceanBase等开源软件的最新进展,NoSQL/NewSQL、内存计算、流计算和图计算技术的发展趋势,OpenStack生态系统对于大数据计算需求的思考,以及大数据下的可视化、机器学习/深度学习、商业智能、数据分析等的最新业界应用,分享实际生产系统中的技术特色和实践经验。
携程资深软件工程师廖晓格将在“大数据技术”分论坛带来“让大数据更实时和可视化”的演讲。大数据不仅是数据规模大,而且最好能实时查看和分析。 实时和可视化拉近了大数据与普通用户的距离,更加贴近业务需要。携程在大数据实时和可视化方面做了不少努力,实现了以下目标,廖晓格将在演讲中分享携程在其中的经验和技术:
廖晓格,携程资深软件工程师
有6年Hadoop相关应用开发经验,先后在PPTV,eBay,携程参与开发过相应大数据平台相关应用,目前在携程Data Infrastructure team负责大数据平台的运维和开发工作。
CSDN:你所在的公司,都曾使用过哪些大数据技术?你对这些技术满意的地方和不满意的地方分别有什么?
廖晓格:我们公司比较重视大数据技术,我们主要使用的技术是Hadoop生态环境的各种开源框架,storm,spark等。满意的地方是他们都是开源的,所以遇到问题的时候总会找到解决方案,而且社区也很活跃, 能够获得很多帮助。同时也会遇到很多bug,需要对使用的框架很了解,才能很好的使用它,幸亏我们有很强大的运维和开发团队支持,不断优化,不断解决问题。
CSDN:根据你的了解,目前类似的企业中,在数据方面,遇到的最大困难是什么?
廖晓格:据我了解,每个公司都有很多数据,每天T级或P级的数据,但是大部分都是搞技术的不懂业务,搞业务的不懂技术,这样就不会很快很有效率的利用数据来帮助业务,所以让大数据可视化很重要,业务人员可以很方便的获取他们想要的数据,可以省去很多沟通的成本。
CSDN:在大数据领域,目前还有哪些技术是你正在观察和研究的,为什么你看好这些技术?
廖晓格:Storm,Streaming流式计算和Spark是我现在正在观察和研究的,互联网的竞争压力很大,所以很多东西要快,谁比较快就占领了优势,大数据也一样,数据早点出来,业务就可以早点做决策。我们也是不断改进,不断往这个目标前进。
CSDN:请谈谈你在这次大会上即将分享的话题。
廖晓格:我分享的是Make big data visualizable and real-time,让大数据更加实时和可视化,携程每天上T的数据都是实时从网站,手机等各种应用端流到服务端,如果没有可视化,根本不知道用户发生什么行为,哪个产品用户更加喜欢。如果计算很慢,我们将会不能给用户很好的反馈,不能及时发现和解决各种应用端遇到的各种问题,这样就不能给用户很好的体验,将会流失大量的用户。我们目标在第一时间为用户提供最优的服务。本文来源:CDA数据分析师官网
CDA学员免费下载查看报告全文:2026全球数智化人才指数报告【CDA数据科学研究院】.pdf
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在中介效应分析中,人口统计学变量(如年龄、性别、学历、收入、职业等)是常见的控制变量或调节变量,其处理方式直接影响分析结 ...
2026-04-29在SQL数据库实操中,日期数据的存储与显示是高频需求,而“数字日期”(如20240520、20241231、45321)是很多开发者、数据分析师 ...
2026-04-29 很多分析师在设计标签时思路清晰,但真到落地环节却面临“数据在手,不知如何转化为可用标签”的困境:或因加工方式选择不当 ...
2026-04-29在手游行业竞争日趋白热化的当下,“流量为王”早已升级为“留存为王”,而付费用户留存率更是衡量一款手游盈利能力、运营质量的 ...
2026-04-28在日常MySQL数据库运维与开发中,经常会遇到“同一台服务器上,两个不同数据库(以下简称“源库”“目标库”)的表数据需要保持 ...
2026-04-28 很多分析师每天和数据打交道,但当被问到“标签是什么”“标签和指标有什么区别”“标签体系如何设计”时,却常常答不上来。 ...
2026-04-28箱线图(Box Plot)作为一种经典的数据可视化工具,广泛应用于统计学、数据分析、科研实证等领域,核心价值在于直观呈现数据的集 ...
2026-04-27实证分析是社会科学、自然科学、经济管理等领域开展研究的核心范式,其核心逻辑是通过对多维度数据的收集、分析与解读,揭示变量 ...
2026-04-27 很多数据分析师精通Excel函数和数据透视表,但当被问到“数据从哪里来”“表和视图有什么区别”“数据库管理系统和SQL是什么 ...
2026-04-27在大数据技术飞速迭代、数字营销竞争日趋激烈的今天,“精准触达、高效转化、成本可控”已成为企业营销的核心诉求。传统广告投放 ...
2026-04-24在游戏行业竞争白热化的当下,用户流失已成为制约游戏生命周期、影响营收增长的核心痛点。据行业报告显示,2024年移动游戏平均次 ...
2026-04-24 很多业务负责人开会常说“我们要数据驱动”,最后却变成“看哪张报表数据多就用哪个”,往往因为缺乏一套结构性的方法去搭建 ...
2026-04-24在Power BI数据可视化分析中,切片器是连接用户与数据的核心交互工具,其核心价值在于帮助使用者快速筛选目标数据、聚焦分析重点 ...
2026-04-23以数为据,以析促优——数据分析结果指导临床技术改进的实践路径 临床技术是医疗服务的核心载体,其水平直接决定患者诊疗效果、 ...
2026-04-23很多数据分析师每天盯着GMV、DAU、转化率,但当被问到“哪些指标是所有企业都需要的”“哪些指标是因行业而异的”“北极星指标和 ...
2026-04-23近日,由 CDA 数据科学研究院重磅发布的《2026 全球数智化人才指数报告》,被中国教育科学研究院官方账号正式收录, ...
2026-04-22在数字化时代,客户每一次点击、浏览、下单、咨询等行为,都在传递其潜在需求与决策倾向——这些按时间顺序串联的行为轨迹,构成 ...
2026-04-22数据是数据分析、建模与业务决策的核心基石,而“数据清洗”作为数据预处理的核心环节,是打通数据从“原始杂乱”到“干净可用” ...
2026-04-22 很多数据分析师每天盯着GMV、转化率、DAU等数字看,但当被问到“什么是指标”“指标和维度有什么区别”“如何搭建一套完整的 ...
2026-04-22在数据分析与业务决策中,数据并非静止不变的数值,而是始终处于动态波动之中——股市收盘价的每日涨跌、企业月度销售额的起伏、 ...
2026-04-21