矩阵是一个由m*n个数排成的m行n列的表称为m行n列的矩阵,简称为m*n矩阵。下面的矩阵是一个3*2(3乘2)矩阵,因为它有三行四列。 在数学的概念中,矩阵(Matrix)是一个按照长方阵列排列的复数或实数集合,最 ...
2020-05-29来源:接地气学堂 作者:接地气的陈老师 很多同学抱怨:每天对着大堆数字,却看不出个名堂。反而有些做业务的人,看几个数字就能马上做出准确判断。咋回事!看着数据没有感觉,是缺少数据洞察力 ...
2020-05-29作者:刘早起 来源:早起python 前言 近期,全国多地以各种形式投放消费券、消费补贴来鼓励消费,部分城市在首期消费券的基础上,连续追加发放多期消费券。于是,不少网友相互比较起来:你在的城市 ...
2020-05-29
1980年代末,汉斯拉伊大学(Hansraj College)经济学荣誉毕业生的平均薪酬约为每年100万印度卢比。这一数字大大高于80年代初或90年代初毕业的人们。 他们平均水平如此之高的原因是什么呢?沙鲁克·汗是印度收入最 ...
2020-05-29前两篇文章介绍了几种常见的条形图,实际上看起来简单的条形图可探索的设置还有很多!在体育赛事中,经常出现一种对称条形图,比如对比两个热门选手或者队伍在各方面的打分情况等,这也是在普通横向条形图的基础上 ...
2020-05-29在我看来,作为一位中国人的我们不管做什么决定都在面临多种选择。例如,如果我这个时候想要买一本书,但是我却不知道我想看什么书、不知道类型、不知道方向,那么这个时候打开各种进行软件搜索可能会出现各种各样 ...
2020-05-29
没有干净的原始数据,为了满足机器学习怼数据的要求,必须过滤数据。例如, 1、查看数据,并排除所有缺少大量数据的列。 2、再次查看数据,然后选择要用于预测的列(特征选择)。进行迭代时,可能需要 ...
2020-05-29
机器学习算法通常分为有监督的(训练数据有标记答案)和无监督的(可能存在的任何标签均未显示在训练算法中)。有监督的机器学习问题又分为分类(预测非数字答案,例如错过抵押贷款的可能性)和回归(预测 ...
2020-05-29
用于实际问题的深度神经网络可能具有10层以上的隐藏层。它的拓扑可能很简单,也可能很复杂。网络中的层越多,它可以识别的特征就越多。不幸的是,网络中的层越多,计算所需的时间就越长,并且训练起来就越困难。 ...
2020-05-27我们最后来讲python另外一个非常出色的可视化工具,使用plotly创建出色的交互式图,最后,不再需要Matplotlib! Plotly具有三个重要功能: · 悬停:将鼠标悬停在图表上时,将弹出注释 · 交互性:无 ...
2020-05-27延续上一篇pandas的文章,我们继续来探讨python中的seaborn,能画出多么高级和漂亮的图标。 漂亮:seaborn的高级绘图
2020-05-27机器学习既是艺术又是科学。但当您查看机器学习算法时,没有一种解决方案或一种适合所有情况的算法。有几个因素会影响您选择哪种机器学习。 有些问题非常具体,需要采取独特的方法。例如,如果您使用推荐系统, ...
2020-05-27两项分别由英国人工智能实验室DeepMind与由德国和希腊的研究人员进行的研究显示了AI与神经网络科学之间有着令人着迷的关系。 就像大多数科学家说的那样,我们距开发能够像人类一样有效地解决问题的人工智能 ...
2020-05-27动态条形图大火了一阵子,尤其是那种对比世界各国历年来的GDP或者军事实力的动态条形图,配上激动人心的音乐,眼看着中国从后往前排名不断考前,作为爱国的人,集体荣誉感爆棚的那种,真的是心潮澎湃自豪到仿佛国 ...
2020-05-27基于python数据可视化的绘图系统matplotlib功能非常强大,按照国际惯例,写在最开始的是对要介绍对象的定义。喏,这是从维基百科搬运过来的对饼图的解释,请安心受下: 饼图,或称饼状图,是一个划分为几个扇形 ...
2020-05-27本篇文章主要介绍了pandas中对series和dataframe对象进行连接的方法:pd.append()和pd.concat(),文中通过示例代码对这两种方法进行了详细的介绍,希望能对各位python小白的学习有所帮助。 一、df.append(d ...
2020-05-27大家在学习算法的时候会学习到关于Kmeans的算法,但是网络和很多机器学习算法书中关于Kmeans的算法理论核心一样,但是代码实现过于复杂,效率不高,不方便阅读。这篇文章首先列举出Kmeans核心的算法过程 ...
2020-05-27python 有很多种方式处理日期和时间,常见的时间处理的模块是datetime、time、calendar。能融汇贯通的了解和使用这三个模块,才能轻而易举地用python处理时间。本文以此为目的,通过讲述各个时间模块的概述、函数 ...
2020-05-26目前,python语音识别越来越流行,今天本系列文章开始,我们将一起探索自动语音识别、语言处理技术所包含的核心算法、模型及未来的发展趋势。本篇文章我们主要讨论语音识别的基本概念。并理解语音识别技术的流程。 ...
2020-05-26以下就是本篇文章的主要内容 我们为什么要选择Jupyter Notebook呢?首先要跟大家说一些,Jupyter NoteBook并不是一个单独的Python编译器,而是在Anaconda这个软件下的一款编译器,在Anaconda下还有其他的编译器 ...
2020-05-26在数据仓库与数据分析体系中,维度表与事实表是构建结构化数据模型的核心组件,二者如同“骨架”与“血肉”,协同支撑起各类业务 ...
2026-01-16在游戏行业“存量竞争”的当下,玩家留存率直接决定游戏的生命周期与商业价值。一款游戏即便拥有出色的画面与玩法,若无法精准识 ...
2026-01-16为配合CDA考试中心的 2025 版 CDA Level III 认证新大纲落地,CDA 网校正式推出新大纲更新后的第一套官方模拟题。该模拟题严格遵 ...
2026-01-16在数据驱动决策的时代,数据分析已成为企业运营、产品优化、业务增长的核心工具。但实际工作中,很多数据分析项目看似流程完整, ...
2026-01-15在CDA(Certified Data Analyst)数据分析师的日常工作中,“高维数据处理”是高频痛点——比如用户画像包含“浏览次数、停留时 ...
2026-01-15在教育测量与评价领域,百分制考试成绩的分布规律是评估教学效果、优化命题设计的核心依据,而正态分布则是其中最具代表性的分布 ...
2026-01-15在用户从“接触产品”到“完成核心目标”的全链路中,流失是必然存在的——电商用户可能“浏览商品却未下单”,APP新用户可能“ ...
2026-01-14在产品增长的核心指标体系中,次日留存率是当之无愧的“入门级关键指标”——它直接反映用户对产品的首次体验反馈,是判断产品是 ...
2026-01-14在CDA(Certified Data Analyst)数据分析师的业务实操中,“分类预测”是高频核心需求——比如“预测用户是否会购买商品”“判 ...
2026-01-14在数字化时代,用户的每一次操作——无论是电商平台的“浏览-加购-下单”、APP的“登录-点击-留存”,还是金融产品的“注册-实名 ...
2026-01-13在数据驱动决策的时代,“数据质量决定分析价值”已成为行业共识。数据库、日志系统、第三方平台等渠道采集的原始数据,往往存在 ...
2026-01-13在CDA(Certified Data Analyst)数据分析师的核心能力体系中,“通过数据建立模型、实现预测与归因”是进阶关键——比如“预测 ...
2026-01-13在企业数字化转型过程中,业务模型与数据模型是两大核心支撑体系:业务模型承载“业务应该如何运转”的逻辑,数据模型解决“数据 ...
2026-01-12当前手游市场进入存量竞争时代,“拉新难、留存更难”成为行业普遍痛点。对于手游产品而言,用户留存率不仅直接决定产品的生命周 ...
2026-01-12在CDA(Certified Data Analyst)数据分析师的日常工作中,“挖掘变量间的关联关系”是高频核心需求——比如判断“用户停留时长 ...
2026-01-12在存量竞争时代,用户流失率直接影响企业的营收与市场竞争力。无论是电商、互联网服务还是金融行业,提前精准预测潜在流失用户, ...
2026-01-09在量化投资领域,多因子选股是主流的选股策略之一——其核心逻辑是通过挖掘影响股票未来收益的各类因子(如估值、成长、盈利、流 ...
2026-01-09在CDA(Certified Data Analyst)数据分析师的工作场景中,分类型变量的关联分析是高频需求——例如“用户性别与商品偏好是否相 ...
2026-01-09数据库中的历史数据,是企业运营过程中沉淀的核心资产——包含用户行为轨迹、业务交易记录、产品迭代日志、市场活动效果等多维度 ...
2026-01-08在电商行业竞争日趋激烈的当下,数据已成为驱动业务增长的核心引擎。电商公司的数据分析师,不仅是数据的“解读官”,更是业务的 ...
2026-01-08