SPSS中异常值检验的几种方法介绍(6)_数据分析师-CDA数据分析师官网

热线电话：13121318867

首页精彩阅读SPSS中异常值检验的几种方法介绍(6)_数据分析师

SPSS中异常值检验的几种方法介绍(6)_数据分析师

2015-01-04

SPSS中异常值检验的几种方法介绍(6)_数据分析师

这样就可以得到统一视图下的选择图了！

数据可视化的艺术——用图表吸引目光（四）——Excel 金字塔图数据可视化的艺术——用图表吸引目光（四）——Excel 金字塔图

这次介绍一个 Excel 的小技巧，关于单元格格式中【数字】这一项的设定。请看上图所示的金字塔图，有没有发现问题？比如下图

按照常规的作图方式，图中突出的两个地方的数字应该是“-9508”和“-15000”。但是在表示人口数量的时候使用负数显然是不合适的。因此我们可以想个办法将 Excel 中的图标转换成 y 轴左右都是正数的形式。

调查数据的加权处理技术

很多人在进行统计分析和市场研究的时候，都涉及到对数据进行加权的问题，这是一个搞数据分析和从事市场

研究的人都会碰到的问题，需要大家正确理解并解释，并采用合理的操作技术和处理方法。什么是加权呢？简单地说，就是要“让一些人变得比另一些人更重要！” 要能够比较好的理解加权，首先你要了解抽样设计，特别是设计权数：每个样本单位所代表的被调查总体的单位数。设计权数由抽样设计决定,用 Wd 表示。设计权数 Wd=1/入样概率；入样概率：在抽样设计中，如果一个样本的入样概率=1/50，那么该样本的设计权数=50。也就是说，这个样本代表了总体中的 50 个单位。关于自加权抽样设计：如果所用样本的设计权数是相等的，那么这样的抽样设计是自加权的。也就是说，总体中的每个单元被抽中的可能性相等，具有等可能性、具有相等的入样概率。如果是自加权的，在总体均值、比例估计时不用考虑设计权数，对总量的估计只要扩大样本。满足自加权的抽样设计：等概率抽样、简单随机抽样、系统抽样、分层抽样—各层大小成比例，每层内简单随机抽样、多阶段抽样—最后阶段等概率，其它阶段与单位大小成比例概率抽样。不等概率抽样往往不满足自加权，对于不等概率抽样，正确使用设计权数就尤为重要了！

下面我们看看如何进行加权处理！加权：通过对总体中的各个样本设置不同的数值系数(即加权因子-权重)，使样本呈现希望的相对重要性程度；基本加权等于：设计加权=某个变量或指标的期望比例/该变量或指标的实际比例；

什么情况下要进行加权？情景 1：我们在抽样调查得到的样本结构与总体人口统计结构状况不相符，我们可以通过加权来消除/还原这种结构差异，达到纠偏的目的；例如，在城市和农村各调查 300 样本，城市与农村人口比例“城市:农村=1:2”(假设)，在分析时我们希望将城市和农场看作一个整体，这时候我们就可以赋予农村样本一个 2 倍于城市样本的权重；情景 2：除了人口统计结构，有时候我们在调查样本的某些变量或指标上样本的代表性可能也会相对总体的实际状况过高/过低，此时，需要加权进行调整；

这类不匹配大多是我们“故意”而为(通过“追加”样本实现)，比如在配额抽样的时候，设置配额要求某类被访者对某产品的使用者必须达到 50%，但实际情况是总体市场中实际使用者仅有 10%；有时，则是“非情愿”的出现，比如设置了能反映总体的配额比例，但实际操作却出现了比例偏高/偏低；情景 3：在样本组配额实验设计中，进行不同子总体对比检验，也会通过加权来调整不同组间的样本属性不相匹配的情形(通常设有相同的配额，但执行有可能会出现差异)；通常，加权对结果产生的差异很小，更多的是对结果从准确度上进行修饰；情景 4：所测试样本出现了较多的缺失值，需要加权来纠正结果；对于面向特定客户的专项研究，在调查前基本都协议有要完成的样本量，故这种情形较少；

CDA数据分析师考试相关入口一览（建议收藏）：

▷ 想报名CDA认证考试，点击>>> “CDA报名” 了解CDA考试详情；