配对样本的T检验和相关样本检验有何差别 最近有很多朋友问我关于如何运用spss配对样本的T检验和相关样本检验有何差别? 配对样本有同源配对(如动物实验中双胞胎)、条件配对(如相同的环境)、自身配对(如 ...
2017-04-24
SPSS实现简单随机抽样 统计学上常用的推断方法之一是参数估计,即从总体中抽取一定数量的样本,计算样本统计量来推断总体的参数。参数估计需要考虑三个问题:如何抽样?抽多大的样本量?如何由样本统计量来推 ...
2017-04-24
python学习笔记—使用dict和set 使用dict和set (一)dict Python内置了字典:dict的支持,dict全称dictionary,在其他语言中也称为map,使用键-值(key-value)存储,具有极快的查找速度。 1.定义字典 字典由 ...
2017-04-23
Python学习笔记—使用list和tuple (一)List 1.Python内置的一种数据类型是列表:list。list是一种有序的集合,可以随时添加和删除其中的元素。 比如,列出班里所有同学的名字,就可以用一个list表示: >>> ...
2017-04-23
Spss的基本方法使用步骤 由于一次的调研工作,我们的数据分析采用spss的统计分析工具,然后我是一个新人,全都是一步一步从零开始操作的。在学习的过程中简单记录了一点笔记,既然写了,就觉得应该把它保存下来 ...
2017-04-23
R语言︱用excel VBA把xlsx批量转化为csv格式 在上面的尝试已经发现,xlsx本身就是这个复杂问题的最根本原因。与之相反,R对csv等文本格式支持的很好,而且有fread这个神器,要处理一定量级的数据,还是得把xlsx ...
2017-04-23
R语言︱文件读入、读出一些方法罗列(批量xlsx文件、数据库、文本txt、文件夹) 小规模的读取数据的方法较为简单并且多样,但是,批量读取目前看到有以下几种方法:xlsx包、RODBC包、批量转化成csv后读入。 R语 ...
2017-04-23
R语言数据分组统计函数族—apply族用法与心得 apply族功能强大,实用,可以代替很多循环语句,R语言中不要轻易使用循环语句。 apply Apply Functions Over Array Margins 对阵列行或者列使用函数 apply(X ...
2017-04-23
R与Excel之数据分析 Excel 是一款很好用的数据分析工具,但是你分析数据时只有 Excel 这一款工具的话,则会大大影响工作效率。相比之下,R 工具更好用,而且提供的工具集模块更完整。 我从事数据分析工作已 ...
2017-04-22
这些Excel学会了,你做账的效率将大大提高 这些功能学会了,工作效率将大大提高。 1、excel的快速访问工具栏: 我的快速访问工具栏由左到右主要是“保存”、“新建”、“撤销”、“恢复”、“升序 ...
2017-04-22
试卷或问卷的可靠度分析 输入你想编的case数目,操作方法:只要将这个程序粘贴到SPSS的脚本窗口,点击RUN即可。到时需要多少记录由你来定。 Sub Main Dim strCmd As String Dim vNbCases As Variant Dim lngN ...
2017-04-22
spss操作(Z) 一、数据定义(data definition) 使计算机能够正确的辨认量化的数据,并对于数据赋予正确的意义。 变量名称指定(变量标签)、变量数值的标签、变量的格式类型、遗漏值的设定。 数据定义必需 ...
2017-04-22
spss里面table的syntax解释 * Custom Tables. CTABLES /VLABELS VARIABLES=status time(参与交叉分析的变量)DISPLAY=DEFAULT /TABLEtime[MEDIAN COMMA40.1] BYstatus(1、by后面的是行变量,前面的是列变 ...
2017-04-22SPSS的特点 1、 操作简单:除了数据录入及部分命令程序等少数输入工作需要键盘键入外,大多数操作可通过“菜单”、“按钮”和“对话框”来完成。 2、 无须编程:具有第四代语言的特点,告诉系统要做什么, ...
2017-04-22
R语言函数收藏||字符串处理-grep/grepl/sub/gsub 处理文本是每一种计算机语言都应该具备的功能,但不是每一种语言都侧重于处理文本。R语言是统计的语言,处理文本不是它的强项,perl语言这方面的功能比R不知要 ...
2017-04-21R语言处理大规模数据集的编程要点 1.提高程序效率,保证执行速度 (1)尽量使用向量化运算 (2)尽量使用矩阵,必要时才使用数据框 (3)使用read.table时,尽量显式设定colClasses和nrows,设定comment.cha ...
2017-04-21
一、正态分布参数检验 例1.某种原件的寿命X(以小时计)服从正态分布N(μ, σ)其中μ, σ2均未知。现测得16只元件的寿命如下: 159 280 101 212 224 379 179 264 222 362 168 250 149 260 485 ...
2017-04-21
如何使用R语言解决可恶的脏数据 在数据分析过程中最头疼的应该是如何应付脏数据,脏数据的存在将会对后期的建模、挖掘等工作造成严重的错误,所以必须谨慎的处理那些脏数据。 脏数据的存在形式主要有如下几种 ...
2017-04-21
一个使用R语言做数据处理的实例 最近一个同学找到我,希望我帮忙处理一份数据。那份数据是这样的:包含了3661行,第一行为各列的名称;包含8列,第一列为专利ID,其余7列为企业ID。 这份数据截图如下所示: ...
2017-04-21
用R语言做Venn(韦恩)图 首先介绍一下韦恩图(英语:Venn diagram) ,也叫做文氏图、温氏图、范氏图,这都一个意思。它是数学学科中分支集合论(或者类的理论)的一支,在不太严格的意义下用来表示集合(或 ...
2017-04-21在数据分析、业务决策、科学研究等领域,统计模型是连接原始数据与业务价值的核心工具——它通过对数据的规律提炼、变量关联分析 ...
2026-02-14在SQL查询实操中,SELECT * 与 SELECT 字段1, 字段2,...(指定个别字段)是最常用的两种查询方式。很多开发者在日常开发中,为了 ...
2026-02-14对CDA(Certified Data Analyst)数据分析师而言,数据分析的核心不是孤立解读单个指标数值,而是构建一套科学、完整、贴合业务 ...
2026-02-14在Power BI实操中,函数是实现数据清洗、建模计算、可视化呈现的核心工具——无论是简单的数据筛选、异常值处理,还是复杂的度量 ...
2026-02-13在互联网运营、产品迭代、用户增长等工作中,“留存率”是衡量产品核心价值、用户粘性的核心指标——而次日留存率,作为留存率体 ...
2026-02-13对CDA(Certified Data Analyst)数据分析师而言,指标是贯穿工作全流程的核心载体,更是连接原始数据与业务洞察的关键桥梁。CDA ...
2026-02-13在机器学习建模实操中,“特征选择”是提升模型性能、简化模型复杂度、解读数据逻辑的核心步骤——而随机森林(Random Forest) ...
2026-02-12在MySQL数据查询实操中,按日期分组统计是高频需求——比如统计每日用户登录量、每日订单量、每日销售额,需要按日期分组展示, ...
2026-02-12对CDA(Certified Data Analyst)数据分析师而言,描述性统计是贯穿实操全流程的核心基础,更是从“原始数据”到“初步洞察”的 ...
2026-02-12备考CDA的小伙伴,专属宠粉福利来啦! 不用拼运气抽奖,不用复杂操作,只要转发CDA真题海报到朋友圈集赞,就能免费抱走实用好礼 ...
2026-02-11在数据科学、机器学习实操中,Anaconda是必备工具——它集成了Python解释器、conda包管理器,能快速搭建独立的虚拟环境,便捷安 ...
2026-02-11在Tableau数据可视化实操中,多表连接是高频操作——无论是将“产品表”与“销量表”连接分析产品销量,还是将“用户表”与“消 ...
2026-02-11在CDA(Certified Data Analyst)数据分析师的实操体系中,统计基本概念是不可或缺的核心根基,更是连接原始数据与业务洞察的关 ...
2026-02-11在数字经济飞速发展的今天,数据已成为核心生产要素,渗透到企业运营、民生服务、科技研发等各个领域。从个人手机里的浏览记录、 ...
2026-02-10在数据分析、实验研究中,我们经常会遇到小样本配对数据的差异检验场景——比如同一组受试者用药前后的指标对比、配对分组的两组 ...
2026-02-10在结构化数据分析领域,透视分析(Pivot Analysis)是CDA(Certified Data Analyst)数据分析师最常用、最高效的核心实操方法之 ...
2026-02-10在SQL数据库实操中,字段类型的合理设置是保证数据运算、统计准确性的基础。日常开发或数据分析时,我们常会遇到这样的问题:数 ...
2026-02-09在日常办公数据分析中,Excel数据透视表是最常用的高效工具之一——它能快速对海量数据进行分类汇总、分组统计,将杂乱无章的数 ...
2026-02-09表结构数据作为结构化数据的核心载体,其“获取-加工-使用”全流程,是CDA(Certified Data Analyst)数据分析师开展专业工作的 ...
2026-02-09在互联网产品运营、用户增长的实战场景中,很多从业者都会陷入一个误区:盲目投入资源做推广、拉新,却忽视了“拉新后的用户激活 ...
2026-02-06