cda

数字化人才认证

大数据时代最该关心的事儿-CDA数据分析师官网

首页 > 大数据时代

关于Kafka,你还需要知道这些!

关于Kafka,你还需要知道这些!
2020-07-16
关于Kafka,相信大家都不陌生,一个消息流的处理平台,目前很多开发人员都把它当做一个生产&消费的中间件。今天小编就跟大家系统介绍一下Kafka,希望对大家有所帮助。 一、Kafka概念 Kafka是一个消息系统, ...

什么是flume?它在大数据处理中起到什么作用?

什么是flume?它在大数据处理中起到什么作用?
2020-07-16
Flume 是 Apache 旗下的一款,开源,可靠性高,扩展性高,管理简单,并且能够支持客户扩展的数据采集系统。 Flume 是使用 JRuby 来构建的,因此依赖于 Java 运行环境。Flume 起初是由 Cloudera 的工程师设计出来, ...

谷歌、脸书、魔兽世界都在用!InnoDB是什么?有哪些关键特性?

谷歌、脸书、魔兽世界都在用!InnoDB是什么?有哪些关键特性?
2020-07-16
导读:InnoDB是事务安全的MySQL存储引擎,设计上采用了类似于Oracle数据库的架构。通常来说,InnoDB存储引擎是OLTP应用中核心表的首选存储引擎。同时,也正是因为InnoDB的存在,才使MySQL数据库变得更有魅力。 ...

数十万数据Excel数据不好处理怎么办?

数十万数据Excel数据不好处理怎么办?
2020-07-16
文章转载自:微信公众号Python的乐趣 作者:一粒米饭 比如像电商行业,每月有上百万条订单发货数据需要与仓库的数据进行核对计算,涉及到数据计算,筛选,匹配等步骤,用excel表超级卡,并且经常卡死。 ...

这三种JS异步加载的方式,你必须掌握!

这三种JS异步加载的方式,你必须掌握!
2020-07-16
通常情况下javascript是默认同步加载的,也就是所说的javascript的加载时阻塞的,后面的页面要等到javascript加载结束后,才能再进行加载,这样对于一些意义不是很大的javascript来说,如果放在页头会导致加载很慢 ...
聊聊Python的一个彩蛋:Python之禅
2020-07-15
相信大家在学习python肯定都听说过python之禅。python之禅到底是个什么东西,设计者为什么要这样设计?又有什么意义呢?看完下面的文章你就会明白了。 文章转载自:微信公众号 Python的乐趣 作者:一粒米饭 ...

几种吊炸天的图,还可以动,了解下??(力导向图,桑基图、树图、弦图)

几种吊炸天的图,还可以动,了解下??(力导向图,桑基图、树图、弦图)
2020-07-15
数据可视化能够很好地展示我们数据分析的结果,对于平常工作中,一份酷炫的可视化图表也能成为我们在工作汇报时的加分项,可是很多小伙伴对于怎样制作吸引人眼球可视化图表却不知晓,今天小编终于为大家找到了集中 ...

pandas库中DataFrame常用基本函数汇总-二元运算

pandas库中DataFrame常用基本函数汇总-二元运算
2020-07-15
DataFrame是python中pandas库里一种常见的数据框结构,也可以看做是一个矩阵形式,单元格能够存放数值、字符串等,类似于表,也可以当做由Series组成的字典。 DataFrame中包含很多基础函数,很多刚接触到DataFra ...

玫瑰图是什么?如何进行绘制?

玫瑰图是什么?如何进行绘制?
2020-07-15
玫瑰图,全称为南丁格尔玫瑰图(Nightingale rose diagram),或者又叫做鸡冠花图、极坐标区域图等。早在克里米亚战争期间,统计学家和医学改革家佛罗伦斯‧南丁格尔 (Florence Nightingale) 就层使用玫瑰图表传达 ...

如何使用python的pandas库来迅速读取EXCEL文件?

如何使用python的pandas库来迅速读取EXCEL文件?
2020-07-15
EXCEL是我们平常工作中使用最多、最方便、最简单的一款数据统计和分析工具,但是如果数据量过大,EXCEL就不那么好用了,甚至连打开也变得非常困难,那么这时候就轮到python出场了。今天小编将会给大家分享如何使用 ...

如何使用seaborn绘制好看的直方图和密度图?

如何使用seaborn绘制好看的直方图和密度图?
2020-07-15
seaborn是一款常用的python可视化库,基于matplotlib,相比matplotlib,seaborn绘制的多数图表都具有统计学意义,如分布、关系、统计、回归等,今天小编跟大家分享的是如何使用seaborn绘制直方图和密度图。 Sea ...

怎样快速简单地安装requests库?

怎样快速简单地安装requests库?
2020-07-15
requests库是一个简单,而且快速处理HTTP请求的第三方库,是目前公认的爬取网页速度最快的库。requests库拥有许多强大的功能,包括:国际域名以及url获取、http长连接、连接缓存等等,更多的详细功能可以参考reque ...

如何快速入门和使用beautifulsoup?

如何快速入门和使用beautifulsoup?
2020-07-15
BeautifulSoup是一款灵活又便捷的HTML/XML的解析器,通常被用来解析和提取 HTML/XML 数据。BeautifulSoup处理速度快,效率高,而且支持多种解析器,不用编写正则表达式也能快速地实现网页信息的提取。 1、Beaut ...

scrapy是什么?如何进行安装?

scrapy是什么?如何进行安装?
2020-07-15
scrapy一个开源和协作的框架,最初的设计目的为:页面抓取(更准确来说是网络抓取),因此scrapy能够以简便、快捷·、可扩展的方式从网站中提取所需的信息。现阶段scrapy的应用十分广泛,能够用于挖掘、监测和自动 ...

这些常用的xpath基础语法,你都知道吗?

这些常用的xpath基础语法,你都知道吗?
2020-07-15
xpath全称为XML Path Language, 是一门从XML中提取数据的语言,通常是利用元素和属性来进行导航的。 一、对于xpath的理解 1、xpath特点: xpath 包含一个标准函数库 xpath 是 XSLT 中的主要元 ...

python 为什么只需一条语句“a,b=b,a”,就能直接交换两个变量?

python 为什么只需一条语句“a,b=b,a”,就能直接交换两个变量?
2020-07-15
Python是一款使用方便,易上手的工具,我们平常在工作中经常会用到,而且同时也是一款功能强大的编程语言,被广泛应用于数据分析、web开发、人工智能等行业。但是无论那个行业,哪个领域,想要熟练使用Python,就 ...

pandas也能修改样式?快速给你的数据换个Style!

pandas也能修改样式?快速给你的数据换个Style!
2020-07-14
Pandas是一款很强大的Python库,具有很多方便的功能,今天小编就给大家分享用Pandas修改样式。 以下内容转载于早起Python微信公众号。 作者:刘早起 文章来源:早起Python 前言 在之前的很多文章中 ...
Hbase是什么?与Hive有哪些区别?
2020-07-14
HbaseE是一个具有高可靠性、高性能特点、面向列、可伸缩的分布式存储系统。利用Hbase技术能够在廉价PC Server上搭建起大规模结构化存储集群。Hbase的目标为:存储并处理大型的数据。更进一步说就是仅需通过普通的 ...

Hive基本介绍及安装应用方法

Hive基本介绍及安装应用方法
2020-07-14
Hive是一款基于Hadoop的数据仓库工具,通常被用于数据提取、转化、加载,可以将结构化的数据文件映射为一张数据库表,并提供类SQL查询功能,能将SQL语句转变成MapReduce任务来执行。Hive最大的优点是学习成本低, ...

数据分析成果落地难?你需要注意这五个问题

数据分析成果落地难?你需要注意这五个问题
2020-07-14
数据分析的最终目的是驱动企业业务增长,今天小编就带大家来看一下数据分析成果落地难的那些问题。 文章来源:微信公众号接地气学堂 作者:接地气的陈老师 落地、见效!是很多做数据分析的同学最怕的 ...

OK