巧用R的write函数实现带,数据txt文件输出 今天天气不错,打开电脑,有一同学问我,他说在做基因分析时,常会出现输出的都是一列形式保存的。然而,在实际应用当中,常会出现以一行的带“,”形式保存的数据。 ...
2017-07-09
R之KNN算法 KNN(k-Nearest Neighbor)分类算法是数据挖掘分类技术中较简单的方法之一。所谓k最近邻,就是k个最近的邻居的意思,说的是每个样本都可以用它最接近的k个邻居来代表。 例如,上图中,绿色圆 ...
2017-07-09
R之回归分析广义线性模型(Generalized Linear Model)glm 1. 介绍 广义线性模型(Generalized Linear Model)是一般线性模型的推广,它使因变量的总体均值通过一个非线性连接函数而依赖于线性预测值,允许响应 ...
2017-07-09
互联网金融未来的核心在于大数据挖掘 时下,查询实时交通路况几乎成为我们出行前必不可少的事情,而这些躲避拥堵的方案真的是实时监控反馈的吗?答案当然是否定的,它主要在于数据分析,即通过带GPS功能的手机 ...
2017-07-09
如何解决机器学习中数据不平衡问题 这几年来,机器学习和数据挖掘非常火热,它们逐渐为世界带来实际价值。与此同时,越来越多的机器学习算法从学术界走向工业界,而在这个过程中会有很多困难。数据不平衡问题虽 ...
2017-07-09
SPSS分析技术:K-均值聚类分析;个体工商户和小型企业也应该做客户分级管理,提高市场竞争力 K-均值聚类法的聚类算法与层次聚类法完全不同。在SPSS软件中,K-均值聚类法是按照如下步骤对个案进行聚类的: 分 ...
2017-07-08
SPSS中如何对多个选项的结果进行计数 对于数据的统计分析来说,有很多人觉得做出p值那一步比较高深。其实不然,数据整理和数据清洗才是吃力不讨好的事情,也能体现出数据处理人员的能力。数据整理与清洗既花费 ...
2017-07-08
SQL Server数据库大型应用解决方案总结 一、负载均衡技术 负载均衡集群是由一组相互独立的计算机系统构成,通过常规网络或专用网络进行连接,由路由器衔接在一起,各节点相互协作、共同负载、均衡压力,对客 ...
2017-07-08
SQL Server之排序函数和开窗函数 Sql Server2005数据库自带一个排序函数ROW_NUMBER(), 列表为: 语法:row_number() : over(子句) 1.使用row_number()函数进行编号: select row_number() over(or ...
2017-07-08
【SQL揭秘】有多少种数据库,就有多少类CTE Common Table Expression Common table expression简称CTE,由SQL:1999标准引入,可以认为是在单个 SELECT、INSERT、UPDATE、DELETE 或 CREATE VIEW 语句的执行范 ...
2017-07-08
R语言之数据管理 数据挖掘最重要的一环就是如何管理你的数据,因为原始数据一般都不能直接用来进行分析,需要对原始数据进行增加衍生变量、数据分箱、数据标准化处理;对因子型变量进行哑变量处理;数据抽样和 ...
2017-07-08
R语言-简单线性回归图-方法 目标:利用R语言统计描绘50组实验对比结果 第一步:导入.csv文件 X <- read.table(\"D:abc11.csv\",header = TRUE, sep = \",\") 第二步:绘图 ...
2017-07-07
R语言-数据预处理 一、日期时间、字符串的处理 日期 Date: 日期类,年与日 POSIXct: 日期时间类,精确到秒,用数字表示 POSIXlt: 日期时间类,精确到秒,用列表表示 Sys.date(), date(), difftime(), ISOdate() ...
2017-07-07
R语言:数据处理包dplyr的函数 dplyr专注处理dataframe对象, 并提供更稳健的与其它数据库对象间的接口。 一、5个关键的数据处理函数: select() 返回列的子集 filter() 返回行的子集 arrange() 根据一 ...
2017-07-07
R语言—日常随笔 1.字符处理函数:paste() 需求:将字符向量中的字符串,用逗号隔开,合并为一句话。 > ##字符向量 > ls_1 [1] \"天津\" \"上海\" \"安徽\" \"福建\" \"四川\" \"重庆\" \"陕西\" \"青海\" \" ...
2017-07-07
数据分析实例--R语言如何对垃圾邮件进行分类 Structure of a Data Analysis 1 数据分析的步骤 l Define the question l Define the ideal data set l Determine what data you can access l Obt ...
2017-07-07R语言时间序列数据应用xts zoo是时间序列的基础库,是面向通用的设计。 xts 是对时间序列库(zoo) 的一种扩展实现。xts 类型继承了zoo 类型,丰富了时间序列数据处理的函数。 一、xts对象的结构和定义 1、 ...
2017-07-07
sas信用评分卡之番外哑变量的生成 哑变量是:举一个例子,假设变量“职业”的取值分别为:工人、农民、学生、企业职员、其他,5种选项,我们可以增加4个哑变量来代替“职业”这个变量,分别为D1(1=工人/0=非工 ...
2017-07-06
SAS的数据导入导出大法 正所谓巧妇难为无米之炊,数据分析首要的问题是数据的获取。 SAS 作为老牌的统计软件发展至今,已经集成了丰富的数据获取与管理功能组件。本章我们就SAS如何获取数据做重点介绍,并顺带 ...
2017-07-06
使用 IBM SPSS Modeler 进行数据挖掘之数据理解 在数据挖掘项目中,数据理解常常不被重视。但其实数据理解在整个数据挖掘项目中扮演着非常重要的角色,可以说是整个项目的基石。在计算机领域有一句话,“Garbag ...
2017-07-06在数据分析、业务决策、科学研究等领域,统计模型是连接原始数据与业务价值的核心工具——它通过对数据的规律提炼、变量关联分析 ...
2026-02-14在SQL查询实操中,SELECT * 与 SELECT 字段1, 字段2,...(指定个别字段)是最常用的两种查询方式。很多开发者在日常开发中,为了 ...
2026-02-14对CDA(Certified Data Analyst)数据分析师而言,数据分析的核心不是孤立解读单个指标数值,而是构建一套科学、完整、贴合业务 ...
2026-02-14在Power BI实操中,函数是实现数据清洗、建模计算、可视化呈现的核心工具——无论是简单的数据筛选、异常值处理,还是复杂的度量 ...
2026-02-13在互联网运营、产品迭代、用户增长等工作中,“留存率”是衡量产品核心价值、用户粘性的核心指标——而次日留存率,作为留存率体 ...
2026-02-13对CDA(Certified Data Analyst)数据分析师而言,指标是贯穿工作全流程的核心载体,更是连接原始数据与业务洞察的关键桥梁。CDA ...
2026-02-13在机器学习建模实操中,“特征选择”是提升模型性能、简化模型复杂度、解读数据逻辑的核心步骤——而随机森林(Random Forest) ...
2026-02-12在MySQL数据查询实操中,按日期分组统计是高频需求——比如统计每日用户登录量、每日订单量、每日销售额,需要按日期分组展示, ...
2026-02-12对CDA(Certified Data Analyst)数据分析师而言,描述性统计是贯穿实操全流程的核心基础,更是从“原始数据”到“初步洞察”的 ...
2026-02-12备考CDA的小伙伴,专属宠粉福利来啦! 不用拼运气抽奖,不用复杂操作,只要转发CDA真题海报到朋友圈集赞,就能免费抱走实用好礼 ...
2026-02-11在数据科学、机器学习实操中,Anaconda是必备工具——它集成了Python解释器、conda包管理器,能快速搭建独立的虚拟环境,便捷安 ...
2026-02-11在Tableau数据可视化实操中,多表连接是高频操作——无论是将“产品表”与“销量表”连接分析产品销量,还是将“用户表”与“消 ...
2026-02-11在CDA(Certified Data Analyst)数据分析师的实操体系中,统计基本概念是不可或缺的核心根基,更是连接原始数据与业务洞察的关 ...
2026-02-11在数字经济飞速发展的今天,数据已成为核心生产要素,渗透到企业运营、民生服务、科技研发等各个领域。从个人手机里的浏览记录、 ...
2026-02-10在数据分析、实验研究中,我们经常会遇到小样本配对数据的差异检验场景——比如同一组受试者用药前后的指标对比、配对分组的两组 ...
2026-02-10在结构化数据分析领域,透视分析(Pivot Analysis)是CDA(Certified Data Analyst)数据分析师最常用、最高效的核心实操方法之 ...
2026-02-10在SQL数据库实操中,字段类型的合理设置是保证数据运算、统计准确性的基础。日常开发或数据分析时,我们常会遇到这样的问题:数 ...
2026-02-09在日常办公数据分析中,Excel数据透视表是最常用的高效工具之一——它能快速对海量数据进行分类汇总、分组统计,将杂乱无章的数 ...
2026-02-09表结构数据作为结构化数据的核心载体,其“获取-加工-使用”全流程,是CDA(Certified Data Analyst)数据分析师开展专业工作的 ...
2026-02-09在互联网产品运营、用户增长的实战场景中,很多从业者都会陷入一个误区:盲目投入资源做推广、拉新,却忽视了“拉新后的用户激活 ...
2026-02-06