spss的方差齐性检验和ANOVA 我用spss做了单因素方差分析,出来两个框,一个是方差齐性检验,那里的显著性是大于0.05,另一个是ANOVA,那里的显著性是小于0.05.到底要看哪个呢 spss的方差齐性检验和ANOVA的参 ...
2017-05-15
SAS建立本地文件夹 SAS建立文件夹:用sas建立数据集市时,通常要生成每日数据并保留起来。 今天分享一段程序,SAS生成每日文件夹、模块文件夹及主题表文件夹并保留每日运行的日志,在下一期,分享日志检 ...
2017-05-14
R语言作为BI中ETL的工具 R语言作为BI中ETL的工具,增删改 R语言提供了强大的R_package与各种数据库进行数据交互。 外加其强大数据变换清洗函数,为ETL提供一条方便快捷的道路。 RODBC ROracal RMysql Rmon ...
2017-05-14
R语言系列:构造拟合公式的几个技巧 在使用各种回归时,需要写明拟合公式。最常见的形式如下: y~x1+x2 #可以增加任意数量的自变量 若要加入自变量之间的交互作用,可以使用以下写法 y~x1+x2+x1:x2 y~(x1+x2) ...
2017-05-14
通俗理解T检验与F检验的区别 1.T检验和F检验的由来 一般而言,为了确定从样本(sample)统计结果推论至总体时所犯错的概率,我们会利用统计学家所开发的一些统计方法,进行统计检定。 通过把所得到的统计检定值 ...
2017-05-14
一个资深数据人对数据挖掘解读 在银行做了两年的数据分析和挖掘工作,较少接触互联网的应用场景,因此,一直都在思考一个问题,“互联网和金融,在数据挖掘上,究竟存在什么样的区别”。在对这个问题的摸索和理 ...
2017-05-14如何一步步从数据产品菜鸟走到骨干数据产品 网上关于数据分析师的文章很多,但是关于数据产品经理的文章很少,所以经常有各个领域的垂直网站来和我交流,问我数据产品应该怎么做,人怎么培养,团队应该怎么建。 ...
2017-05-14
数据分析该分析什么 很多时候我们走的走的就会忘记当初为什么而出发。我们有的时候在拿到数据以后不知道该怎么进行分析,该去分析什么,其实这些在我们以前的统计学中都学过。 不管是用Python还是R,其实和 ...
2017-05-13
使用Python一步一步地来进行数据分析 你已经决定来学习Python,但是你之前没有编程经验。因此,你常常对从哪儿着手而感到困惑,这么多Python的知识需要去学习。以下这些是那些开始使用Python数据分析的初学者的 ...
2017-05-13
为什么机器学习的框架都偏向于Python 总结:好写、支持全面、好调、速度不慢。 1.Python是解释语言,这让写程序方便不只一点。举例来说,在C等编译语言里写一个矩阵乘法,需要自己分配操作数(矩阵)的内存 ...
2017-05-13
说说什么是数据挖掘 数据挖掘就是指从数据中获取知识。 好吧,这样的定义方式比较抽象,但这也是业界认可度最高的一种解释了。对于如何开发一个大数据环境下完整的数据挖掘项目,业界至今仍没有统一的规范 ...
2017-05-13
一行R代码来实现繁琐的可视化 ggfortify 是一个简单易用的R软件包,它可以仅仅使用一行代码来对许多受欢迎的R软件包结果进行二维可视化,这让统计学家以及数据科学家省去了许多繁琐和重复的过程,不用对结果进 ...
2017-05-13
机器学习的道、法、术、势、器 “道、法、术、器”出于老子的《道德经》,后人又加了一个“势”,并且也有了不同的排列。很多人习惯用“道、法、术、势、器”的顺序,原因很简单:道以明向、法以立本、术以立策 ...
2017-05-13
sas信用评分之手动对数值变量分组 上周内容已经有了预告,就是除了我之前发表的最优分段,我自认为比较实际的分段方法这个方法我是借鉴了别人的经验已经根据自己的业务经验做的手工分组,相对于之前的最优分组 ...
2017-05-12
SAS信用评分之模型拟合以及验证的大坑 今天的内容是来讲我这段时间被模型拟合和模型验证坑过的那些事。我也是千辛万苦终于是把模型给建出来了。此处应该有掌声。因为模型老是效果不好这件事,我躲在被窝里哭了 ...
2017-05-12
sas信用评分之评分卡的生成 今天介绍的“信用风险评分卡研究”中的生成评分卡的代码,哪一章生成评分卡我琢磨了好久,所以我觉得要是有疑惑的可以看下我写的这篇文章。至于理论的东西我就不说,基本要学评分卡 ...
2017-05-12
判别分析的基本思想以及常见的判别分析方法 判别分析的基本概念及应用 从统计的角度来看,判别分析可以描述为:已知有个总体,现有样本y,要根据这k个总体和当前样本的特征,判定该样本y属于哪一个总体。其 ...
2017-05-12
做运营必须掌握的数据分析思维,你还敢说不会做数据分析 对于运营数据分析,我相信很多小伙伴会存在以下问题: 面对异常数据经常出现“好像做了什么?好像发生了什么?所以可能造成了影响”的主观臆测? ...
2017-05-12SAS日志检测 以前跑数据集市时,通常是每天自己批量跑,如果每天查看日志非常麻烦。今天给大家分享一段数据日志的检测代码,可以判断是是哪天出错了。如下图所示: [xmy_1487668820/2017-05-05-16-06-49-9355.p ...
2017-05-12
R语言之grep函数和正则通配符查 在R语言的道路上又学到了一个新知识,记下来一起分享! 首先,grep函数可以像数据库查询一样对向量中的具有特定条件的元素进行查询! 其次,介绍几种R语言中 ...
2017-05-11箱线图(Box Plot)作为一种经典的数据可视化工具,广泛应用于统计学、数据分析、科研实证等领域,核心价值在于直观呈现数据的集 ...
2026-04-27实证分析是社会科学、自然科学、经济管理等领域开展研究的核心范式,其核心逻辑是通过对多维度数据的收集、分析与解读,揭示变量 ...
2026-04-27 很多数据分析师精通Excel函数和数据透视表,但当被问到“数据从哪里来”“表和视图有什么区别”“数据库管理系统和SQL是什么 ...
2026-04-27在大数据技术飞速迭代、数字营销竞争日趋激烈的今天,“精准触达、高效转化、成本可控”已成为企业营销的核心诉求。传统广告投放 ...
2026-04-24在游戏行业竞争白热化的当下,用户流失已成为制约游戏生命周期、影响营收增长的核心痛点。据行业报告显示,2024年移动游戏平均次 ...
2026-04-24 很多业务负责人开会常说“我们要数据驱动”,最后却变成“看哪张报表数据多就用哪个”,往往因为缺乏一套结构性的方法去搭建 ...
2026-04-24在Power BI数据可视化分析中,切片器是连接用户与数据的核心交互工具,其核心价值在于帮助使用者快速筛选目标数据、聚焦分析重点 ...
2026-04-23以数为据,以析促优——数据分析结果指导临床技术改进的实践路径 临床技术是医疗服务的核心载体,其水平直接决定患者诊疗效果、 ...
2026-04-23很多数据分析师每天盯着GMV、DAU、转化率,但当被问到“哪些指标是所有企业都需要的”“哪些指标是因行业而异的”“北极星指标和 ...
2026-04-23近日,由 CDA 数据科学研究院重磅发布的《2026 全球数智化人才指数报告》,被中国教育科学研究院官方账号正式收录, ...
2026-04-22在数字化时代,客户每一次点击、浏览、下单、咨询等行为,都在传递其潜在需求与决策倾向——这些按时间顺序串联的行为轨迹,构成 ...
2026-04-22数据是数据分析、建模与业务决策的核心基石,而“数据清洗”作为数据预处理的核心环节,是打通数据从“原始杂乱”到“干净可用” ...
2026-04-22 很多数据分析师每天盯着GMV、转化率、DAU等数字看,但当被问到“什么是指标”“指标和维度有什么区别”“如何搭建一套完整的 ...
2026-04-22在数据分析与业务决策中,数据并非静止不变的数值,而是始终处于动态波动之中——股市收盘价的每日涨跌、企业月度销售额的起伏、 ...
2026-04-21在数据分析领域,当研究涉及多个自变量与多个因变量之间的复杂关联时,多变量一般线性分析(Multivariate General Linear Analys ...
2026-04-21很多数据分析师精通描述性统计,能熟练计算均值、中位数、标准差,但当被问到“用500个样本如何推断10万用户的真实满意度”“这 ...
2026-04-21在数据处理与分析的全流程中,日期数据是贯穿业务场景的核心维度之一——无论是业务报表统计、用户行为追踪,还是风控规则落地、 ...
2026-04-20在机器学习建模全流程中,特征工程是连接原始数据与模型效果的关键环节,而特征重要性分析则是特征工程的“灵魂”——它不仅能帮 ...
2026-04-20很多数据分析师沉迷于复杂的机器学习算法,却忽略了数据分析最基础也最核心的能力——描述性统计。事实上,80%的商业分析问题, ...
2026-04-20在数字化时代,数据已成为企业决策的核心驱动力,数据分析与数据挖掘作为解锁数据价值的关键手段,广泛应用于互联网、金融、医疗 ...
2026-04-17