CDA数据科学研究院 CDA考试中心 企业服务 关于CDA

cda

全国校区

首页 > 技术干货

SAS中的协方差分析

SAS中的协方差分析
2017-05-29
SAS中的协方差分析 所谓的协方差分析,就是在方差分析的基础上加上协变量这一额外因素,而方差分析则只考虑组变量这一因素。协变量可以有一个,也可以有多个。 在这篇文章中,我只讲述单变量的协方差分析。 ...

R语言分类算法之随机森林

R语言分类算法之随机森林
2017-05-29
R语言分类算法之随机森林 1.原理分析: 随机森林是通过自助法(boot-strap)重采样技术,从原始训练样本集N中有放回地重复随机抽取k个样本生成新的训练集样本集合,然后根据自助样本集生成k个决策树组成的随 ...

R语言实战k-means聚类和关联规则算法

R语言实战k-means聚类和关联规则算法
2017-05-29
R语言实战k-means聚类和关联规则算法 1、R语言关于k-means聚类 数据集格式如下所示: [plain] view plain copy ,河东路与岙东路&河东路与聚贤桥路,河东路与岙东路&新悦路与岙东路,河东路与岙东路&火炬路与聚贤 ...

R语言实现人工神经网络预测

R语言实现人工神经网络预测
2017-05-29
R语言实现人工神经网络预测 R语言中很多包(package)关于神经网络,例如nnet、AMORE、neuralnet以及RSNNS。nnet提供了最常见的前馈反向传播神经网络算法。AMORE包则更进一步提供了更为丰富的控制参数,并可以 ...

SAS中最常用的10个命令

SAS中最常用的10个命令
2017-05-29
SAS中最常用的10个命令 SAS是乔伊平时学习中常用到的数据处理软件之一。在处理大批量数据时,SAS不能说太好用呢。SAS也是学习起来十分简单的一个软件,掌握一些基本的命令,就可以满足日常的数据处理需求。 ...
sas信用评分之不用检查异常值的最优分组
2017-05-29
sas信用评分之不用检查异常值的最优分组 今天的更新比以往晚了一天,假期综合症第一天,我到现在已经喝了第三杯咖啡,实现上周的预告,这种更新一个不用检查异常值的数值变量最优分组。其实这代码我本来不想拿 ...

SPSS分析技术:多重线性回归模型;极端值与多重共线性的识别与处理

SPSS分析技术:多重线性回归模型;极端值与多重共线性的识别与处理
2017-05-28
SPSS分析技术:多重线性回归模型;极端值与多重共线性的识别与处理 如果拟合质量不好,可能存在的问题主要有以下两个方面: 极端值(强点)的影响。我们都知道,在线性回归分析中,自变量回归系数的确定主 ...

SPSS分析技术:分段拟合;电业局如何通过简单的回归模型来预测居民用电量

SPSS分析技术:分段拟合;电业局如何通过简单的回归模型来预测居民用电量
2017-05-28
SPSS分析技术:分段拟合;电业局如何通过简单的回归模型来预测居民用电量 今天给大家介绍利用分段回归模型拟合的办法来处理一些特殊的变量关系。某些变量之间的关系非常有趣,不是恒久的线性或非线性关系,可能 ...

SPSS分析技术:最小一乘法;制造企业如何合理安排生产计划

SPSS分析技术:最小一乘法;制造企业如何合理安排生产计划
2017-05-28
SPSS分析技术:最小一乘法;制造企业如何合理安排生产计划 最小二乘法的原理是以预测值和实测值之差(残差)的平方和达到最小作为判断模型优劣的评判标准,应用十分广泛。没有放之四海而皆准的真理,最小二乘法同 ...

Hadoop常见错误和处理方式

Hadoop常见错误和处理方式
2017-05-28
Hadoop常见错误和处理方式 常见问题及处理 mysql版本,必须是MYSQL5.1。 查询办法mysqladmin version 在建立hive数据库的时候,最好是:create database hive; oozie的数据库,同样:create databa ...
Hadoop常见的45个问题解答
2017-05-28
Hadoop常见的45个问题解答 时至今日,Hadoop已成为最流行的离线数据处理平台,然而它的集群配置起来并不简单。如果你学习Hadoop不久,相信下面这45个问题会对你有所帮助。 在工作生活中,有些问题非常简 ...
Hadoop Hive sql语法详解
2017-05-28
Hadoop Hive sql语法详解 Hive是基于Hadoop构建的一套数据仓库分析系统,它提供了丰富的SQL查询方式来分析存储在Hadoop 分布式文件系统中的数据,可以将结构 化的数据文件映射为一张数据库表,并提供完整的S ...

详解SQL集合运算

详解SQL集合运算
2017-05-27
详解SQL集合运算 本文主要是对集合运算中并集、交集、差集运算基础的总结。 集合运算包含四种: 1.并集运算(两种) 2.交集运算 3.差集运算 下面是集合运算的思维导图: 为什么使用集合 ...

利用SQL查询扶贫对象医保报销比率的审计方法

利用SQL查询扶贫对象医保报销比率的审计方法
2017-05-27
利用SQL查询扶贫对象医保报销比率的审计方法 扶贫资金惠及贫困百姓的切身利益,主管部门多,资金实行逐级下拨,并且扶贫项目小而分散,主要在乡镇和农村实施。根据湖北省审计厅关于2017年扶贫审计工作方案的精 ...

SQL Server数据库的存储过程中定义的临时表,真的有必要显式删除(drop table #tableName)吗

SQL Server数据库的存储过程中定义的临时表,真的有必要显式删除(drop table #tableName)吗
2017-05-27
SQL Server数据库的存储过程中定义的临时表,真的有必要显式删除(drop table #tableName)吗 在写SQL Server存储过程中,如果存储过程中定义了临时表,有些人习惯在存储过程结束的时候一个一个显式地删除过程 ...

SQL经典面试题 - 行列转换

SQL经典面试题 - 行列转换
2017-05-27
SQL经典面试题 - 行列转换 在我们的实际工作中,为了研发出功能完整、系统健壮的软件,需要我们测试人员想法设法的去挑出软件的问题,所以很多公司对测试人员的要求甚至高于开发人员,而通过SQL语句的编写,测 ...
SQL LDR默认字符最大长度限制问题
2017-05-27
SQL LDR默认字符最大长度限制问题 场景: 上游的文件导入系统报超过字段长度。 现象: 该字段有256个字节,而表的字段COL1长度为VARCHAR2(500),按理说不应该超长。 分析: ...
sql语句优化的13中方法
2017-05-27
sql语句优化的13中方法 1,什么是“执行计划”? 执行计划是数据库根据SQL语句和相关表的统计信息作出的一个查询方案,这个方案是由查询优化器自动分析产生的,比如一条SQL语句如果用来从一个 10万条记录的 ...

在PHP中全面阻止SQL注入式攻击

在PHP中全面阻止SQL注入式攻击
2017-05-26
在PHP中全面阻止SQL注入式攻击 一、 注入式攻击的类型 可能存在许多不同类型的攻击动机,但是乍看上去,似乎存在更多的类型。这是非常真实的-如果恶意用户发现了一个能够执行多个查询的办法的话。 如果你 ...

SQL语句优化技巧

SQL语句优化技巧
2017-05-26
SQL语句优化技巧 1、应尽量避免在 where 子句中使用!=或<>操作符,否则将引擎放弃使用索引而进行全表扫描。 2、对查询进行优化,应尽量避免全表扫描,首先应考虑在 where 及 order by 涉及的列上建立索引。 ...

OK