以下使用scikit-learn中数据集进行分享。 如果选用随机森林作为最终的模型,那么找出它的最佳参数可能有1000多种组合的可能,你可以使用使用穷尽的网格搜索(Exhaustive Grid Seaarch)方法,但时间成本将会很 ...
2020-06-10pandas datetime # datetime.timedelta 时间差 t1 = datetime.datetime(2017,10,1) print(t1) print(\"\") tx = datetime.timedelta(100) # timedelta(days=0, seconds=0, microseconds=0, milliseconds=0, m ...
2020-06-10今天我们来详细讲解下,Linux浏览文件的三种命令,它们分别是:cat、less、more! cat命令: 一次性在终端中显示文件的所有内容 cat Facebook首席运营官桑德伯格《Lean\\ In》.txt cat命令显示出 ...
2020-06-10Affinity Propogation最初是由Brendan Frey 和 Delbert Dueck于2007年在Science上提出的。相比其它的层次聚类算法,Affinity Propogation算法不需要预先指定聚类个数。 Affinity Propogation算法的原理可以简单 ...
2020-06-10Numpy基础数据结构 import numpy as np ar = np.array([[1,2,3], [3,4,6], [4,5,7]]) # 二维数组 print(ar) print(type(ar)) ar [[1 2 3] [3 4 6] [4 5 7]] array([[1, 2, 3], [3, 4, 6], [4, 5, 7] ...
2020-06-10CDA数据分析师 出品 相信大家在做一些算法经常会被庞大的数据量所造成的超多计算量需要的时间而折磨的痛苦不已,接下来我们围绕四个方法来帮助大家加快一下Python的计算时间,减少大家在算法上的等待 ...
2020-06-09CDA数据分析师 出品 相信大家在做一些算法经常会被庞大的数据量所造成的超多计算量需要的时间而折磨的痛苦不已,接下来我们围绕四个方法来帮助大家加快一下Python的计算时间,减少大家在算法上的等待 ...
2020-06-09虽然在图论中,python可视化已经占据的一定优势,但是不可否认,微软公司的excel仍然占有一席之地。 Excel是Microsoft为使用Windows和Apple Macintosh操作系统的电脑编写的一款电子表格软件。直观的界面、出色 ...
2020-06-09延续上次图论的文章,我们继续为大家介绍几个用起来更顺手的小技巧。相信大家在工作中都遇到过在Excel中插入各种符号或者特殊标识的数字的时候比较苦恼,其实这些符号的插入也是有操作小技巧的哦! 一、 快捷键 ...
2020-06-09我们生活在大数据时代的背景之下 ,单单是我们个人每天就会产生各种各样的数据,对于企业来说,更是一样。 像之前乔布斯掌舵的苹果等,几乎每个大中型企业都有自己的ERP或者OA系统,日积月累就会帮企业存储大量 ...
2020-06-09理论物理学家和研究科学家Mehmet Suzen曾表示,二分类任务是机器学习的基础。但是,其性能的标准统计信息是一种数学工具,ROC-AUC很难解释。在这里,引入了一种性能度量,该度量仅考虑进行正确的二进制分类的可能 ...
2020-06-09前面我们介绍了mysql数据库中的建表导表的步骤以及基础的SELECT语句,本篇再基于第一篇文章的数据基础上我们梳理下聚合和分组。 对表进行聚合学习重点 使用聚合函数对表中的列进行计算合计值或者平均 ...
2020-06-09上一篇文章我们介绍了mysql数据库中的建表导表的步骤,本篇再基于上篇文章的数据基础上我们介绍下SELECT语句 一.SELECT语句基础 学习要点 使用SELECT从表中选取数据。 为列设定显示用的别名。 ...
2020-06-09大家好,相信很多学习数据分析的小伙伴在面试前都经历过刷题,本系列小编将带大家一起来刷一刷mysql面试必会的经典50题。 当然本系列文章不单单是刷题,小编会带着大家梳理一下解题时用到的知识点,所以基础比 ...
2020-06-09
尽管深度学习在人工智能领域做出了巨大贡献,但它还是有一个不太好的地方:它需要大量数据。这是深度学习的先驱者和批评家都同意的一件事。实际上,由于有用数据的有限可用性有限以及处理该数据的计算能力不 ...
2020-06-09
CDA数据分析师 出品 相信大家在做一些算法经常会被庞大的数据量所造成的超多计算量需要的时间而折磨的痛苦不已,接下来我们围绕四个方法来帮助大家加快一下python的计算时间,减少大家在算法上的等待 ...
2020-06-08
CDA数据分析师 出品 相信大家在做一些算法经常会被庞大的数据量所造成的超多计算量需要的时间而折磨的痛苦不已,接下来我们围绕四个方法来帮助大家加快一下Python的计算时间,减少大家在算法上的等待时间。 ...
2020-06-05这节我们来聊一下用户留存的话题,用户留存有多重要呢?“不留存,就去死”,听起来还是有点耸人听闻的对吧。说到留存,不得不先弄清楚用户画像,所谓“知己知彼,百战不殆!” 很多大佬们往往更关注留存这 ...
2020-06-05Hadoop通过改变其配置文件来更改运行模式,我们通过修改如下四个配置文件core-site.xml、hdfs-site.xml、mapred-site.xml和yarn-site.xml即可让Hadoop以伪分布模式运行。 Hadoop的配置文件是 xml 格式,每个配 ...
2020-06-04接着上文我们来聊一下“用户激活”这个话题,提到用户激活,怎么样的营销决策是好的呢?相信很多同学脑海都浮现一个词,没错,就是“Aha”时刻,用户激活是离不开Aha时刻的。 如何定义它呢?Aha(惊喜)时刻, ...
2020-06-04在数据仓库与数据分析体系中,维度表与事实表是构建结构化数据模型的核心组件,二者如同“骨架”与“血肉”,协同支撑起各类业务 ...
2026-01-16在游戏行业“存量竞争”的当下,玩家留存率直接决定游戏的生命周期与商业价值。一款游戏即便拥有出色的画面与玩法,若无法精准识 ...
2026-01-16为配合CDA考试中心的 2025 版 CDA Level III 认证新大纲落地,CDA 网校正式推出新大纲更新后的第一套官方模拟题。该模拟题严格遵 ...
2026-01-16在数据驱动决策的时代,数据分析已成为企业运营、产品优化、业务增长的核心工具。但实际工作中,很多数据分析项目看似流程完整, ...
2026-01-15在CDA(Certified Data Analyst)数据分析师的日常工作中,“高维数据处理”是高频痛点——比如用户画像包含“浏览次数、停留时 ...
2026-01-15在教育测量与评价领域,百分制考试成绩的分布规律是评估教学效果、优化命题设计的核心依据,而正态分布则是其中最具代表性的分布 ...
2026-01-15在用户从“接触产品”到“完成核心目标”的全链路中,流失是必然存在的——电商用户可能“浏览商品却未下单”,APP新用户可能“ ...
2026-01-14在产品增长的核心指标体系中,次日留存率是当之无愧的“入门级关键指标”——它直接反映用户对产品的首次体验反馈,是判断产品是 ...
2026-01-14在CDA(Certified Data Analyst)数据分析师的业务实操中,“分类预测”是高频核心需求——比如“预测用户是否会购买商品”“判 ...
2026-01-14在数字化时代,用户的每一次操作——无论是电商平台的“浏览-加购-下单”、APP的“登录-点击-留存”,还是金融产品的“注册-实名 ...
2026-01-13在数据驱动决策的时代,“数据质量决定分析价值”已成为行业共识。数据库、日志系统、第三方平台等渠道采集的原始数据,往往存在 ...
2026-01-13在CDA(Certified Data Analyst)数据分析师的核心能力体系中,“通过数据建立模型、实现预测与归因”是进阶关键——比如“预测 ...
2026-01-13在企业数字化转型过程中,业务模型与数据模型是两大核心支撑体系:业务模型承载“业务应该如何运转”的逻辑,数据模型解决“数据 ...
2026-01-12当前手游市场进入存量竞争时代,“拉新难、留存更难”成为行业普遍痛点。对于手游产品而言,用户留存率不仅直接决定产品的生命周 ...
2026-01-12在CDA(Certified Data Analyst)数据分析师的日常工作中,“挖掘变量间的关联关系”是高频核心需求——比如判断“用户停留时长 ...
2026-01-12在存量竞争时代,用户流失率直接影响企业的营收与市场竞争力。无论是电商、互联网服务还是金融行业,提前精准预测潜在流失用户, ...
2026-01-09在量化投资领域,多因子选股是主流的选股策略之一——其核心逻辑是通过挖掘影响股票未来收益的各类因子(如估值、成长、盈利、流 ...
2026-01-09在CDA(Certified Data Analyst)数据分析师的工作场景中,分类型变量的关联分析是高频需求——例如“用户性别与商品偏好是否相 ...
2026-01-09数据库中的历史数据,是企业运营过程中沉淀的核心资产——包含用户行为轨迹、业务交易记录、产品迭代日志、市场活动效果等多维度 ...
2026-01-08在电商行业竞争日趋激烈的当下,数据已成为驱动业务增长的核心引擎。电商公司的数据分析师,不仅是数据的“解读官”,更是业务的 ...
2026-01-08