最近在看人民的名义这部剧,但是有一点我不是很满意:如果错过了七点过的电视直播(我从来没准时看过),那么就只能等到凌晨十二点,视频网站才会更新。我理解电视台想保证收视率的这点小心思,但这么做也太折磨人了 ...
2017-04-12一. 对数据科学家而言,最重要的技能和工具是什么?如何获得? 在 90% 的情况下,在大学中所学的技能对于实际中的数据科学项目并不是很有用。在实际项目中,起码需要掌握以下四种编程技术: ...
2017-04-11还记得之前推送过的一篇讲大连天气数据可视化的文章吗,后来有小伙伴儿直呼不过瘾,墙裂要求来一个北京版。 小编我日夜赶工,终于出炉了北京版的空气质量数据可视化,而且相比之前大连版的有所升级: ...
2017-04-10当获得一份数据集时,你会怎么做? 立马撩起袖管进行分析么?这不是一个好建议。无数的经验告诉我们,如果分析师不先行了解数据集的质量,后续的推断分析是事倍功半的。 正确的处理方法是先 ...
2017-04-07《釜山行》是一部丧尸灾难片,其人物少、关系简单,非常适合我们学习文本处理。这个项目将介绍共现在关系中的提取,使用 R 编写代码实现对《釜山行》文本的人物关系进行分析 使用到的R包 li ...
2017-04-06来自 Glassdoor 的最新数据可以告诉我们各大科技公司最近在招聘面试时最喜欢向候选人提什么问题。首先有一个令人惋惜的结论:根据统计,几乎所有的公司都有着自己的不同风格。由于 Glassdoor 允许匿名提交内容,很 ...
2017-04-05前言 在大数据时代,很多公司开始利用数据、分析数据,以协助自己做出正确的市场决策。数据的来源多种多样,而社交媒体是一个重要的数据来源渠道。那么国外的公司是如何挖掘社交媒体数据的呢? 在小学 ...
2017-03-31本文使用银联智惠信息服务(上海)有限公司 提供的2016年线下城市消费力大数据,对中国的地域差异进行了一个小小的研究。 选取了全国 300 余个地级市作为研究对象,并以城市发展水平和所属地理区位对城 ...
2017-03-30概述 HBase 是一个开源的非关系型分布式数据库(NoSQL),基于谷歌的 BigTable 建模,是一个高可靠性、高性能、高伸缩的分布式存储系统,使用 HBase 技术可在廉价 PC Server 上搭建起大规模结构化 ...
2017-03-29各类 paper 是有一定的借鉴意义的,不过这主要是学术界在单个问题上的细化,要真正从研究领域落地到大数据的处理还有很多工作要做。 一、工程上的处理流程 工程上的处理流程具体包括 ...
2017-03-28前言 工作和家庭难以兼顾吗?美国程序员小哥实力演绎如何在带娃的同时,在一年内获得五项开发者认证和第二学位的。 我边工作边带娃的场景 CD Baby 的创始人 Derek Sivers 曾说:“所 ...
2017-03-27于是我希望,在七周成为数据分析师的系列后,把数据化运营作为第二个系列来完成。每次写文章,对自己也是一种总结和提升。 下面是一份「简略」的大纲,更恰当地说是草稿。当不久的将来开始正式写 ...
2017-03-23[泰坦尼克号问题之背景] 就是那个大家都熟悉的『Jack and Rose』的故事,豪华游艇倒了,大家都惊恐逃生,可是救生艇的数量有限,无法人人都有,副船长发话了『lady and kid first!』,所以是否获救其实 ...
2017-03-221、电视媒体 大数据应用案例之电视媒体——对于体育爱好者,追踪电视播放的最新运动赛事几乎是一件不可能的事情,因为有超过上百个赛事在 8000 多个电视频道播出。而现在市面上有开发者开发了一个 ...
2017-03-211.北漂都是哪里人 根据第六次全国人口普查数据,北漂的来源地有非常明显的特征—— 其实只看该省入京的绝对数量,已经基本能发现一些端倪,但还不够确信。我们再加上一个数据佐证,即“流入北京人口占当 ...
2017-03-20最近有篇31岁员工因PPT做的太丑而被公司炒了的消息火了朋友圈, 看到这条消息后艺术细胞极端匮乏如作者的奇葩网店数据分析员小奇开始坐立不安了。因为明天就是向老板汇报去年网店运营销售情况的日子, ...
2017-03-17Growth Hacking 这个词在过去一两年开始迅速从硅谷传播到国内,也诞生了一系列专注于企业数据分析业务的明星初创公司,如 GrowingIO,神策数据,诸葛IO 等。 Growth Hacking 简单的来说就是用数据驱动的方式 ...
2017-03-16这次,罂粟姐姐悄悄告诉你们 Excel 数据透视表的 10 个秘密。当然,如果有 1 个及以上的秘密是你之前不知道的,就果断打赏转发吧。(如果你全知道,呃……大神求带~) 1、手动刷新和定时刷新 ...
2017-03-15我们都熟悉“人工智能”这一概念。毕竟,这个词常常在热门电影中出现,如《终结者》、《黑客帝国》、《机械姬》。 但最近你也可能常常听到其他术语,如“机器学习”和“深度学习”,这些词有时与人工智能交 ...
2017-03-14数据科学是一个蓬勃发展的产业,相关大数据的职业也成为热门,给人才发展带来带来了很多机会。数据科学家、数据工程师等已经成为大数据行业最热门的职位。今天让我们先来看一下这两种职业之间的区别,具体的工作, ...
2017-03-13