作者 | Julia Kho 编译 | CDA数据分析师 Annotated Heatmaps of a Correlation Matrix in 5 Simple Steps 热图是数据的图形表示,也就是说,它使用颜色来向读者传达价值。当您拥有大 ...
2019-09-29
作者 | Edwin Lisowski 编译 | CDA数据分析师 XGBoost and Random Forest with Bayesian Optimisation 在这篇文章中,我们将介绍带有贝叶斯优化算法的两种流行的算法即XGBoost和随机 ...
2019-09-28
作者 | 吴子劲 来源 | 网易数读 又是一年开学季,一批新生踏入高校。很快他们就可以通过入门课程,了解自己所在的专业究竟学什么。几个月后,学期结束,不知道会对自己大半年前的选择感受如 ...
2019-09-28
作者 | Destiny 来源 | 木东居士 0x00 前言 在之前的文章中,已经分享过如何根据数据可视化的目的、数据关系和特征,去选择合适的图表类型。当确定了要使用哪些图表进行数据可视化 ...
2019-09-27
作者 | Boris Knyazev 编译 | 栗峰 来源 | 深度学习这件小事 最近,Graph Neural Network(GNN)在很多领域日益普及,包括社交网络、知识图谱、推荐系统甚至于生命科学。GNN在对节点 ...
2019-09-27
作者 | Destiny 来源 | 木东居士 0x00 前言 在之前分享的【数据图表的选择】三篇文章中,已经把不同类型数据图表的用法和适用场景做了一遍梳理。但是,在实际的业务场景中,如何根据拥有 ...
2019-09-26
作者 | Saurabh Hooda 出品 | CDA数据分析师 What is the Best Python IDE for Data Science? m创建,于1991年首次发布,解释的高级编程语言是为通用编程而开发的。Python解释器可在 ...
2019-09-26
作者 | Jamie Beach 编译 | AI开发者 Top 5 Insights After I Spent 100 Days Learning About Artificial Intelligence 本文的作者是 Jamie Beach,在自学人工智能 100 天以后,他分 ...
2019-09-26
作者 | Badreesh Shetty 整理 | 大数据文摘 说起分类算法,相信学过机器学习的同学都能侃上一二。 可是,你能够如数家珍地说出所有常用的分类算法,以及他们的特征、优缺点吗?比如说, ...
2019-09-25
作者 | By Luciano Strika 来源 | CDA数据分析研究院 5 Probability Distributions Every Data Scientist Should Know 概率分布就像3D眼镜。它们允许熟练的数据科学家识别其他完全随 ...
2019-09-25
作者 | Daniel Newman 编译 | 张大笔茹 来源|网络大数据 4 Growing Enterprise AI Trends: Where Are We Now And Where Are We Going? 人工智能比传统的工业自动化和数据处理 ...
2019-09-24
作者 | 顾家彤、鲍歆祎 来源 | 读芯术 如果要列举一项彻底改变了21世纪的技术,非人工智能莫属。现如今,人工智能已然成为我们日常生活的一部分,不断丰富和便捷着社会的方方面面,今天这篇 ...
2019-09-24
作者 | Destiny 来源 | 木东居士 0x00 前言 之前已经分享过「趋势型(时间序列)」、「比例型」、「对比型」、「分布型」数据的可视化图表方式。 今天这篇,是数据图表选择的最后一 ...
2019-09-24作者 | 林实憨 来源 | 小白读财经 房租有多贵 近期,一线城市房租上涨了不少,不少大学毕业生头疼不已。 为此,我与北京财经大咖猫哥聊了这一话题。 猫哥说,上个月大舅妈的孩子 ...
2019-09-23
0x00 前言 不同的数据类型、不同的阐述目的,决定了数据可视化展现形式的差异。因此,今天这篇文章,主要是分享两类不同的可视化目的及其可选择的图表形式。 在实际工作中,我们经常需要对比多组 ...
2019-09-23
作者 | Destiny 来源 | 木东居士 0x00 前言 第1篇文章《数据可视化过程》发出后,通过居士收到一些读者的反馈,大家的共同心声是,希望在后续的文章中,结合具体的业务场景,多分享一些 ...
2019-09-23
作者 | Destiny 来源 | 木东居士 0x00 前言 前面写过一篇文章,叫做《数据可视化的基本流程》,是站在可视化过程中的上下游关系,来梳理和介绍数据可视化的全过程,及其各个环节的主要工 ...
2019-09-20
作者 | 秦路 来源 | tracykanc 谈到数据驱动业务,离不开数据是怎么来的,数据收集是整个数据生命周期的初始环节。 数据生命周期的大体介绍,在过去的一篇文章中有提到。虽然文章的部分 ...
2019-09-20
作者 | 沉迷数据的DT君 来源 | DT财经 城市对年轻人的渴望从来没有如此急切。 自2016年以来,越来越多城市围绕落户、住房和就业发布宽松政策,想要吸引更多年轻人。新增人口数量也成为许 ...
2019-09-19
作者 | CDA数据分析师 10 machine learning methods that every data scientist should know 机器学习是研究和工业中的热门话题,新方法一直在发展。该领域的速度和复杂性使得即使对于专家而 ...
2019-09-19在数字化时代,数据已成为企业决策的核心驱动力,数据分析与数据挖掘作为解锁数据价值的关键手段,广泛应用于互联网、金融、医疗 ...
2026-04-17在数据处理、后端开发、报表生成与自动化脚本中,将 SQL 查询结果转换为字符串是一项高频且实用的操作。无论是拼接多行数据为逗 ...
2026-04-17面对一份上万行的销售明细表,要快速回答“哪个地区卖得最好”“哪款产品增长最快”“不同客户类型的购买力如何”——这些看似复 ...
2026-04-17数据分析师一天的工作,80% 的时间围绕表格结构数据展开。从一张销售明细表到一份完整的分析报告,表格结构数据贯穿始终。但你真 ...
2026-04-16在机器学习无监督学习领域,Kmeans聚类因其原理简洁、计算高效、可扩展性强的优势,成为数据聚类任务中的主流算法,广泛应用于用 ...
2026-04-16在机器学习建模实践中,特征工程是决定模型性能的核心环节之一。面对高维数据集,冗余特征、无关特征不仅会增加模型训练成本、延 ...
2026-04-16在数字化时代,用户是产品的核心资产,用户运营的本质的是通过科学的指标监测、分析与优化,实现“拉新、促活、留存、转化、复购 ...
2026-04-15在企业数字化转型、系统架构设计、数据治理与AI落地过程中,数据模型、本体模型、业务模型是三大核心基础模型,三者相互支撑、各 ...
2026-04-15数据分析师的一天,80%的时间花在表格数据上,但80%的坑也踩在表格数据上。 如果你分不清数值型和文本型的区别,不知道数据从哪 ...
2026-04-15在人工智能与机器学习落地过程中,模型质量直接决定了应用效果的优劣——无论是分类、回归、生成式模型,还是推荐、预测类模型, ...
2026-04-14在Python网络编程、接口测试、爬虫开发等场景中,HTTP请求的发送与响应处理是核心需求。Requests库作为Python生态中最流行的HTTP ...
2026-04-14 很多新人学完Python、SQL,拿到一张Excel表还是不知从何下手。 其实,90%的商业分析问题,都藏在表格的结构里。 ” 引言:为 ...
2026-04-14在回归分析中,因子(即自变量)的筛选是构建高效、可靠回归模型的核心步骤——实际分析场景中,往往存在多个候选因子,其中部分 ...
2026-04-13在机器学习模型开发过程中,过拟合是制约模型泛化能力的核心痛点——模型过度学习训练数据中的噪声与偶然细节,导致在训练集上表 ...
2026-04-13在数据驱动商业升级的今天,商业数据分析已成为企业精细化运营、科学决策的核心手段,而一套规范、高效的商业数据分析总体流程, ...
2026-04-13主讲人简介 张冲,海归统计学硕士,CDA 认证数据分析师,前云南白药集团资深数据分析师,自媒体 Python 讲师,全网课程播放量破 ...
2026-04-13在数据可视化与业务分析中,同比分析是衡量业务发展趋势、识别周期波动的核心手段,其核心逻辑是将当前周期数据与上年同期数据进 ...
2026-04-13在机器学习模型的落地应用中,预测精度并非衡量模型可靠性的唯一标准,不确定性分析同样不可或缺。尤其是在医疗诊断、自动驾驶、 ...
2026-04-10数据本身是沉默的,唯有通过有效的呈现方式,才能让其背后的规律、趋势与价值被看见、被理解、被运用。统计制图(数据可视化)作 ...
2026-04-10在全球化深度发展的今天,跨文化传播已成为连接不同文明、促进多元共生的核心纽带,其研究核心围绕“信息传递、文化解读、意义建 ...
2026-04-09