CDA数据科学研究院 CDA考试中心 企业服务 关于CDA

cda

全国校区

首页 > 技术干货

SPSS统计分析案例:多层感知器神经网络

SPSS统计分析案例:多层感知器神经网络
2017-05-22
SPSS统计分析案例:多层感知器神经网络 神经网络模型起源于对人类大脑思维模式的研究,它是一个非线性的数据建模工具, 由输入层和输出层、 一个或者多个隐藏层构成神经元,神经元之间的连接赋予相关的权重, 训 ...

如何对数据排序和拆分文件

如何对数据排序和拆分文件
2017-05-22
如何对数据排序和拆分文件 排序数据 对个案进行排序(排序数据文件的行)通常很有用,且有时对于某些类型的分析是十分必要的。根据一个或多个排序变量的值重新排序数据文件中个案的顺序: 从菜单中选择: ...

SPSS统计基础---代码本

SPSS统计基础---代码本
2017-05-22
SPSS统计基础---代码本 大家好,从今天开始,将逐步介绍SPSS各个统计方法菜单中每个选项的含义及使用。 码本报告活动数据集中所有或指定变量和多重响应集的字典信息(如变量名称、变量标签、值标签、缺失值 ...

SPSS统计基础---描述功能的使用

SPSS统计基础---描述功能的使用
2017-05-22
SPSS统计基础---描述功能的使用 “描述”过程为单个表中的若干变量显示单变量摘要统计量,并计算标准化值(z 得分)。变量可以按其均值(升序或降序)大小、按字母顺序或按您选择变量的顺序(缺省值)进行排序 ...

SPSS统计基础---频率的使用

SPSS统计基础---频率的使用
2017-05-22
SPSS统计基础---频率的使用 频率过程提供有助于描述多种类型的变量的统计量和图形显示。频率过程是查看数据理想的开始位置。对于频率报告和条形图,可以用升序或降序排列不同的值,也可以按其频率对类别进行排 ...

你真的会玩SQL吗?之逻辑查询处理阶段

你真的会玩SQL吗?之逻辑查询处理阶段
2017-05-21
你真的会玩SQL吗?之逻辑查询处理阶段 最近要对数据库进行优化,但由于工作项目中已经很少亲自写SQL而且用的都不是很复杂的语句,所以有些生疏了,于是翻翻N年前的笔记资料,想以此来记录回顾总结一些实用的SQL ...

0基础搭建Hadoop大数据处理-环境

0基础搭建Hadoop大数据处理-环境
2017-05-21
0基础搭建Hadoop大数据处理-环境 由于Hadoop需要运行在Linux环境中,而且是分布式的,因此个人学习只能装虚拟机,本文都以VMware Workstation为准,安装CentOS7,具体的安装此处不作过多介绍,只作需要用到的知 ...

提升数据建模的10种技术措施

提升数据建模的10种技术措施
2017-05-21
提升数据建模的10种技术措施 随着企业有了能够轻松访问和分析数据以提高性能的新机会,数据建模也是变形的。数据建模不仅仅是任意组织数据结构和关系,还必须与最终用户的需求和问题联系起来,并提供指导,帮助 ...

0基础搭建Hadoop大数据处理-初识

0基础搭建Hadoop大数据处理-初识
2017-05-21
0基础搭建Hadoop大数据处理-初识 在互联网的世界中数据都是以TB、PB的数量级来增加的,特别是像BAT光每天的日志文件一个盘都不够,更何况是还要基于这些数据进行分析挖掘,更甚者还要实时进行数据分析,学习, ...

Hadoop集群搭建

Hadoop集群搭建
2017-05-21
Hadoop集群搭建 目的 本文描述了如何安装、配置和管理有实际意义的Hadoop集群,其规模可从几个节点的小集群到几千个节点的超大集群。 如果你希望在单机上安装Hadoop玩玩,从这里能找到相关细节。 先决 ...

Hadoop面试中6个常见的问题及答案

Hadoop面试中6个常见的问题及答案
2017-05-21
Hadoop面试中6个常见的问题及答案 准备好面试了吗?呀,需要Hadoop的知识!!?不要慌!这里有一些可能会问到的问题以及你应该给出的答案。 Q1.什么是Hadoop? Hadoop是一个开源软件框架,用于存储大量数 ...

关于数据分析思路的4点心得

关于数据分析思路的4点心得
2017-05-20
关于数据分析思路的4点心得 1.看数据的纬度 在对一款产品或者一款产品的其中的一个模块进行分析时,我们可以从两个大纬度去分析数据。 首先是从广阔的视角先去查看数据,这里需要对该产品所处的行业数据 ...

商业数据挖掘的几种应用场景和主题

商业数据挖掘的几种应用场景和主题
2017-05-20
商业数据挖掘的几种应用场景和主题 数据挖掘涉及到公司运营的方方面面,这包括对企业部门经营情况的评估、内部员工的管理、生产流程的监管、产品结构优化与新产品开发、财务成本优化、市场结构的分析和客户关系 ...

关于如何解释机器学习的一些方法

关于如何解释机器学习的一些方法
2017-05-20
关于如何解释机器学习的一些方法 到现在你可能听说过种种奇闻轶事,比如机器学习算法通过利用大数据能够预测某位慈善家是否会捐款给基金会啦,预测一个在新生儿重症病房的婴儿是否会罹患败血症啦,或者预测一位 ...
R语言并行计算的原理和案例
2017-05-20
R语言并行计算的原理和案例 众所周知,在大数据时代R语言有两个弱项,其中一个就是只能使用单线程计算。但是R在2.14版本之后,R就内置了parallel包,强化了R的并行计算能力。 parallel包实际上整合了之前已 ...

机器学习需要哪些数学基础

机器学习需要哪些数学基础
2017-05-20
机器学习需要哪些数学基础 过去的几个月中,有几人联系我,诉说他们对尝试进入数据科学的世界,以及用机器学习的技术去探索统计规律并构建无可挑剔的数据驱动型产品的热忱。然而,我发现一些人实际上缺乏必要的 ...

R语言:关联规则+时间因素=序贯关联规则

R语言:关联规则+时间因素=序贯关联规则
2017-05-19
R语言:关联规则+时间因素=序贯关联规则 序贯模型=关联规则+时间因素。 今天下午基本上把通过arulesSequences来进行序列模式挖掘搞明白了,晚上又把arulesSequences中最重要的函数cspade查看了一下。Mark一下。 ...

python实现六大分群质量评估指标(兰德系数、互信息、轮廓系数)

python实现六大分群质量评估指标(兰德系数、互信息、轮廓系数)
2017-05-19
python实现六大分群质量评估指标(兰德系数、互信息、轮廓系数) 1 R语言中的分群质量——轮廓系数 因为先前惯用R语言,那么来看看R语言中的分群质量评估,节选自笔记︱多种常见聚类模型以及分群质量评估(聚类 ...

R语言︱词典型情感分析文本操作技巧汇总(打标签、词典与数据匹配等)

R语言︱词典型情感分析文本操作技巧汇总(打标签、词典与数据匹配等)
2017-05-19
R语言︱词典型情感分析文本操作技巧汇总(打标签、词典与数据匹配等) 情感分析中对文本处理的数据的小技巧要求比较高,笔者在学习时候会为一些小技巧感到头疼不已。 主要包括以下内容: 1 批量读取txt ...

R语言︱集合运算—小而美法则

R语言︱集合运算—小而美法则
2017-05-19
R语言︱集合运算—小而美法则 集合运算的一般规则如下: union(x,y) #求并集 intersect(x,y) #求交集 setdiff(x,y) #求属于x而不属于y的所有元素 setequal(x,y) #判断x与y是否相等 a %in% y #判断a是否为y ...

OK