无监督学习是机器学习里的一种学习方式,下面将给大家具体解释一下无监督学习到底是什么? 首先我们可以对照监督学习来对比理解一下无监督学习的概念。 机器学习中,监督学习是一种明确的训练方式,你能够很 ...
2020-06-30
在机器学习中经常会遇到两个概念:线性、非线性。今天就让我们一起来看以下线性与非线性的。 一、一般在线性代数中,线性有以下两个特征: 齐次性:f(a*x)=a*f(x); 可叠加行:f(x+y)=f(x)+f(y)。 只要 ...
2020-06-30二八原则,又叫帕累托原则,二八定律,是世界上有一种公认的企业定律,20%的人掌握着80%的财富,源出处就是80/20帕累托法则。在进行商业分析过程中,最常用到的就是一种模型。 从商业分析方面来说,二八原则的 ...
2020-06-30客户价值一词大家都不陌生,指的是客户对企业的创利能力,那么应该如何来评估客户价值呢?经常用到的客户价值评估模型有以下三种。 一、RFM模型 RFM模型可以说是最简单、最实用的一种评估客户价值的方法了, ...
2020-06-30作者:莫凡 来源:大数据DT(ID:hzdashuju) 导读:12306为什么要设置那么复杂的验证码机制呢?就是因为OCR。 今天聊OCR。 OCR是人工智能、机器学习特别是深度学习,在图像识别方向最为重要的应用之一。 ...
2020-06-29PowerBI是微软推出的一种的交互式报表工具,能够把的静态数据报表转换为效果酷炫的可视化的报表,还能够根据filter条件,动态筛选数据,对数据进行不同层面和维度的分析。通俗点来说,Power BI本质是一款数据分析 ...
2020-06-29文章来源:数据分析与统计学之美 作者:黄伟呢 目录 1.scipy库中各分布对应的方法 from scipy import stats # 正态分布 stats.norm # 卡方分布 stats.chi2 # t分布 stats.t # F分布 ...
2020-06-29RFM模型,在众多的商业分析的客户细分模型中,是应用最广泛的一种模型。RFM模型,是根据客户活的跃程度和交易额的贡献来衡量客户价值和客户创利能力的重要工具和手段。 据美国数据库营销研究所Arthur Hughes的 ...
2020-06-29函数大家都知道,那么窗口函数呢?窗口是标准的SQL术语,用来描述SQL语句内OVER子句划定的内容,这个内容就是窗口函数的作用域。下面就跟小编一起来看窗口函数的具体内容吧。 窗口函数是 SQL 中一类特别的函数, ...
2020-06-29科技创新是经济发展的根本动力。在如今这一时代,AI人工智能就是推动经济发展的最重要的科技动力。特别是近些年来行业与AI人工智能的结合,释放了行业的潜力,重塑着人们的日常工作和生活。在AI人工智能备受关注、 ...
2020-06-29
相信大家在一定有接触过偏态分布这一概念,在统计学偏态分布,是指统计数据峰值与平均值不相等的频率分布。根据峰值小于或大于平均值可分为正偏函数和负偏函数,其偏离的程度可用偏态系数刻画。在数据预处理过程中 ...
2020-06-29作者:Boris Scholl, Trent Swanson, Peter Jausovec 来源:大数据DT(ID:hzdashuju) 内容摘编自《云原生:运用容器、函数计算和数据构建下一代应用》 导读:数据库通常用来存储结构化数据,这些数据有明 ...
2020-06-28最近与数据分析相关的岗位越来越火热,各行各业对于准也数据分析师的需求也不断扩大,但是还有一些人对于数据分析师并不了解,不知道数据分析师是做什么的?对企业来说有什么用?小面小编就给大家分享一下数据分析师 ...
2020-06-28不知道大家有没有接触过“元数据”一词,元数据贯穿了数据仓库的整个生命周期,使用元数据驱动数据仓库的开发,使数据仓库自动化,可视化。下面,就让我们来看一下什么是“元数据”。 按照传统的定义,元数据(M ...
2020-06-28用户画像是指根据用户的属性、用户偏好、生活习惯、用户行为等信息而抽象出来的标签化用户模型。通俗说就是给用户打标签,而标签是通过对用户信息分析而来的高度精炼的特征标识。通过打标签可以利用一些高度概括、 ...
2020-06-28大数据是未来发展必然趋势,不懂数据分析很可能在将来会被时代所淘汰,所以现在很多人都争抢学习数据分析,而且很多人都是零基础学习。零基础学习数据分析是有一定难度的,需要大家提前做一些准备。下面,小编就来 ...
2020-06-28数据可视化是数据分析中最好展示数据的方法,能够形象地绘制对应的图像,能够让人更直观地理解数据。下面小编整理了几种数据可视化工具,希望对各位小伙伴有所帮助。 1.Excel Excel是很多人使用的数据可视化 ...
2020-06-28商业智能(Business Intelligence,简称:BI),又称商业智慧或商务智能,指用现代数据仓库技术、线上分析处理技术、数据挖掘和数据展现技术进行数据分析以实现商业价值。 商业智能的概念在1996年最早由加特纳集 ...
2020-06-28【导语】:今天我们来聊聊粽子,Python分析部分请看第三部分。 又到一年端午节,作为中华民族的传统节日,传说粽子是为祭奠投江的屈原而传承下来的,如今吃粽子也成了端午的主要习俗之一。除了商场出售的 ...
2020-06-28
CDA数据分析师证书的含金量很高,第12届CDA数据分析师认证考试报名将在7月5日截止,还没有报名的小伙伴抓紧时间报名了,已经报名成功的小伙伴再检查一遍,看是否有信息填写错误,以免影响之后的考试成绩通知和 ...
2020-06-25在数据驱动决策成为企业核心竞争力的今天,A/B测试已从“可选优化工具”升级为“必选验证体系”。它通过控制变量法构建“平行实 ...
2025-12-01在时间序列预测任务中,LSTM(长短期记忆网络)凭借对时序依赖关系的捕捉能力成为主流模型。但很多开发者在实操中会遇到困惑:用 ...
2025-12-01引言:数据时代的“透视镜”与“掘金者” 在数字经济浪潮下,数据已成为企业决策的核心资产,而CDA数据分析师正是挖掘数据价值的 ...
2025-12-01数据分析师的日常,常始于一堆“毫无章法”的数据点:电商后台导出的零散订单记录、APP埋点收集的无序用户行为日志、传感器实时 ...
2025-11-28在MySQL数据库运维中,“query end”是查询执行生命周期的收尾阶段,理论上耗时极短——主要完成结果集封装、资源释放、事务状态 ...
2025-11-28在CDA(Certified Data Analyst)数据分析师的工具包中,透视分析方法是处理表结构数据的“瑞士军刀”——无需复杂代码,仅通过 ...
2025-11-28在统计分析中,数据的分布形态是决定“用什么方法分析、信什么结果”的底层逻辑——它如同数据的“性格”,直接影响着描述统计的 ...
2025-11-27在电商订单查询、用户信息导出等业务场景中,技术人员常面临一个选择:是一次性查询500条数据,还是分5次每次查询100条?这个问 ...
2025-11-27对数据分析从业者和学生而言,表结构数据是最基础也最核心的分析载体——CRM系统的用户表、门店的销售明细表、仓库的库存表,都 ...
2025-11-27在业务数据可视化中,热力图(Heat Map)是传递“数据密度与分布特征”的核心工具——它通过颜色深浅直观呈现数据值的高低,让“ ...
2025-11-26在企业数字化转型中,业务数据分析师是连接数据与决策的核心纽带。但“数据分析师”并非单一角色,从初级到高级,其职责边界、能 ...
2025-11-26表格结构数据以“行存样本、列储属性”的规范形态,成为CDA数据分析师最核心的工作载体。从零售门店的销售明细表到电商平台的用 ...
2025-11-26在pandas数据处理工作流中,“列标签”(Column Labels)是连接数据与操作的核心桥梁——它不仅是DataFrame数据结构的“索引标识 ...
2025-11-25Anaconda作为数据科学领域的“瑞士军刀”,集成了Python解释器、conda包管理工具及海量科学计算库,是科研人员、开发者的必备工 ...
2025-11-25在CDA(Certified Data Analyst)数据分析师的日常工作中,表格结构数据是最常接触的“数据形态”——从CRM系统导出的用户信息表 ...
2025-11-25在大数据营销从“粗放投放”向“精准运营”转型的过程中,企业常面临“数据维度繁杂,核心影响因素模糊”的困境——动辄上百个用 ...
2025-11-24当流量红利逐渐消退,“精准触达、高效转化、长效留存”成为企业营销的核心命题。大数据技术的突破,让营销从“广撒网”的粗放模 ...
2025-11-24在商业数据分析的全链路中,报告呈现是CDA(Certified Data Analyst)数据分析师传递价值的“最后一公里”,也是最容易被忽视的 ...
2025-11-24在数据可视化实践中,数据系列与数据标签的混淆是导致图表失效的高频问题——将数据标签的样式调整等同于数据系列的维度优化,或 ...
2025-11-21在数据可视化领域,“静态报表无法展现数据的时间变化与维度关联”是长期痛点——当业务人员需要分析“不同年份的区域销售趋势” ...
2025-11-21