配对样本的T检验和相关样本检验有何差别 最近有很多朋友问我关于如何运用spss配对样本的T检验和相关样本检验有何差别? 配对样本有同源配对(如动物实验中双胞胎)、条件配对(如相同的环境)、自身配对(如 ...
2017-04-24
SPSS实现简单随机抽样 统计学上常用的推断方法之一是参数估计,即从总体中抽取一定数量的样本,计算样本统计量来推断总体的参数。参数估计需要考虑三个问题:如何抽样?抽多大的样本量?如何由样本统计量来推 ...
2017-04-24
python学习笔记—使用dict和set 使用dict和set (一)dict Python内置了字典:dict的支持,dict全称dictionary,在其他语言中也称为map,使用键-值(key-value)存储,具有极快的查找速度。 1.定义字典 字典由 ...
2017-04-23
Python学习笔记—使用list和tuple (一)List 1.Python内置的一种数据类型是列表:list。list是一种有序的集合,可以随时添加和删除其中的元素。 比如,列出班里所有同学的名字,就可以用一个list表示: >>> ...
2017-04-23
Spss的基本方法使用步骤 由于一次的调研工作,我们的数据分析采用spss的统计分析工具,然后我是一个新人,全都是一步一步从零开始操作的。在学习的过程中简单记录了一点笔记,既然写了,就觉得应该把它保存下来 ...
2017-04-23
R语言︱用excel VBA把xlsx批量转化为csv格式 在上面的尝试已经发现,xlsx本身就是这个复杂问题的最根本原因。与之相反,R对csv等文本格式支持的很好,而且有fread这个神器,要处理一定量级的数据,还是得把xlsx ...
2017-04-23
R语言︱文件读入、读出一些方法罗列(批量xlsx文件、数据库、文本txt、文件夹) 小规模的读取数据的方法较为简单并且多样,但是,批量读取目前看到有以下几种方法:xlsx包、RODBC包、批量转化成csv后读入。 R语 ...
2017-04-23
R语言数据分组统计函数族—apply族用法与心得 apply族功能强大,实用,可以代替很多循环语句,R语言中不要轻易使用循环语句。 apply Apply Functions Over Array Margins 对阵列行或者列使用函数 apply(X ...
2017-04-23
R与Excel之数据分析 Excel 是一款很好用的数据分析工具,但是你分析数据时只有 Excel 这一款工具的话,则会大大影响工作效率。相比之下,R 工具更好用,而且提供的工具集模块更完整。 我从事数据分析工作已 ...
2017-04-22
这些Excel学会了,你做账的效率将大大提高 这些功能学会了,工作效率将大大提高。 1、excel的快速访问工具栏: 我的快速访问工具栏由左到右主要是“保存”、“新建”、“撤销”、“恢复”、“升序 ...
2017-04-22
试卷或问卷的可靠度分析 输入你想编的case数目,操作方法:只要将这个程序粘贴到SPSS的脚本窗口,点击RUN即可。到时需要多少记录由你来定。 Sub Main Dim strCmd As String Dim vNbCases As Variant Dim lngN ...
2017-04-22
spss操作(Z) 一、数据定义(data definition) 使计算机能够正确的辨认量化的数据,并对于数据赋予正确的意义。 变量名称指定(变量标签)、变量数值的标签、变量的格式类型、遗漏值的设定。 数据定义必需 ...
2017-04-22
spss里面table的syntax解释 * Custom Tables. CTABLES /VLABELS VARIABLES=status time(参与交叉分析的变量)DISPLAY=DEFAULT /TABLEtime[MEDIAN COMMA40.1] BYstatus(1、by后面的是行变量,前面的是列变 ...
2017-04-22SPSS的特点 1、 操作简单:除了数据录入及部分命令程序等少数输入工作需要键盘键入外,大多数操作可通过“菜单”、“按钮”和“对话框”来完成。 2、 无须编程:具有第四代语言的特点,告诉系统要做什么, ...
2017-04-22
R语言函数收藏||字符串处理-grep/grepl/sub/gsub 处理文本是每一种计算机语言都应该具备的功能,但不是每一种语言都侧重于处理文本。R语言是统计的语言,处理文本不是它的强项,perl语言这方面的功能比R不知要 ...
2017-04-21R语言处理大规模数据集的编程要点 1.提高程序效率,保证执行速度 (1)尽量使用向量化运算 (2)尽量使用矩阵,必要时才使用数据框 (3)使用read.table时,尽量显式设定colClasses和nrows,设定comment.cha ...
2017-04-21
一、正态分布参数检验 例1.某种原件的寿命X(以小时计)服从正态分布N(μ, σ)其中μ, σ2均未知。现测得16只元件的寿命如下: 159 280 101 212 224 379 179 264 222 362 168 250 149 260 485 ...
2017-04-21
如何使用R语言解决可恶的脏数据 在数据分析过程中最头疼的应该是如何应付脏数据,脏数据的存在将会对后期的建模、挖掘等工作造成严重的错误,所以必须谨慎的处理那些脏数据。 脏数据的存在形式主要有如下几种 ...
2017-04-21
一个使用R语言做数据处理的实例 最近一个同学找到我,希望我帮忙处理一份数据。那份数据是这样的:包含了3661行,第一行为各列的名称;包含8列,第一列为专利ID,其余7列为企业ID。 这份数据截图如下所示: ...
2017-04-21
用R语言做Venn(韦恩)图 首先介绍一下韦恩图(英语:Venn diagram) ,也叫做文氏图、温氏图、范氏图,这都一个意思。它是数学学科中分支集合论(或者类的理论)的一支,在不太严格的意义下用来表示集合(或 ...
2017-04-21在 MySQL 查询性能优化体系中,索引是降低查询耗时、提升数据库吞吐的核心手段。其中联合索引与覆盖索引是实际开发中最高频的两 ...
2026-06-15在数据仓库建设与商业智能分析体系中,维度建模是应用最广泛的建模方法论,而事实表与维度表是维度建模的两大核心构件,共同构成 ...
2026-06-15 很多数据分析师能熟练计算指标,但当被问到“这家企业的核心业务目标是什么”“如何把模糊的战略目标拆解为可量化的指标”“ ...
2026-06-15在数据分析、业务监控、运营复盘等场景中,列值趋势计算是核心需求之一。无论是分析销售额的月度增长、用户活跃的变化趋势、库存 ...
2026-06-12在数字经济深度渗透的当下,消费者的购买行为已从过去的 “被动接受” 转变为 “主动决策”。流量红利消退、获客成本攀升、用户 ...
2026-06-12CDA三级认证是三个级别中的塔尖,全面考察数据战略、团队领导和复杂项目的综合能力。它所对应的《敏捷数据挖掘》教材,不再局限 ...
2026-06-12在游戏产业的商业逻辑中,付费玩家是支撑游戏生存与发展的核心支柱。行业普遍遵循 “二八定律”:20% 的付费玩家贡献了游戏 80% ...
2026-06-11【核心关键词】企业、定位、传统、产品、互联网、可视化、业务侧、数字化、结构化、数据分析、传统制造业、市场状态、发展空间 ...
2026-06-11 解读《CDA二级教材:量化策略分析(2025)》的全景结构与学习逻辑 ” CDA二级认证是企业招聘数据分析师时最常提及的证书门槛 ...
2026-06-11【核心关键词】药企、可视化、营销、分类、数据分析师、销售数据、业务人员、指导方向、分析报告、营销数据、营销医生 【专访摘 ...
2026-06-10在统计学分析、问卷调研、实验验证、业务复盘等场景中,卡方检验与 T 检验是应用最广泛的两类基础假设检验方法。前者专门处理分 ...
2026-06-10 很多数据分析师每天都在计算指标、制作报表,但当被问到“什么叫指标数据元”“指标数据标准包含哪些核心维度”“指标数据质 ...
2026-06-10在MySQL数据库日常查询、数据统计、后台接口开发、数据导出等场景中,开发者经常需要查询数据表除某几列之外的所有字段。例如查 ...
2026-06-09在Python网络请求、爬虫开发、接口测试、数据抓取等实操场景中,requests库是最常用的第三方请求工具,而content属性是requests ...
2026-06-09 数据分析正在重塑每一个行业。CDA认证的三本官方教材,分别对应Level I、Level II、Level III,为你铺就从业务数据分析到数 ...
2026-06-09在数字财务、智慧财税、业财融合深度推进的当下,传统财务模式下数据标准混乱、业务流程碎片化、知识无法沉淀、系统互通性差等问 ...
2026-06-08随着数字经济深度渗透各行各业,数据正式成为继土地、劳动力、资本、技术之后的第五大生产要素,是企业数字化转型、精细化运营、 ...
2026-06-08 很多数据分析师能熟练写SQL、做透视表,但当被问到“数据是从哪里来的?经过哪些加工才进入数据仓库?ETL具体做了什么?”时 ...
2026-06-08【核心关键词】贷款、报表、课程、专业、建模、缺失值、营销、互联网、银行、办公自动化、数据分析、数据预处理、特征工程、贷 ...
2026-06-05在数据库数据查询、业务报表统计、多表关联分析中,LEFT JOIN左连接是使用率最高的SQL关联查询语句。其核心特性是保留左表全部数 ...
2026-06-05