京公网安备 11010802034615号
经营许可证编号:京B2-20210330
伦敦德比大数据:切尔西往绩占优 降盘不降水
面对大数据的考验,传统媒体站在十字路口。一方面,新闻的内容正在发生变化,数据可以拓展新闻报道的内容,挖掘有价值的联系和规律。另一方面,新闻的呈现方式也在发生变化,可视化的程度更高。然而,利用大数据做新闻,记者还面临着一系列值得注意的问题。而我国新闻媒体运用大数据报道新闻方面尚处于初级探索阶段,需要借鉴国际同行的经验。
大数据新闻报道魅力何在?
【背景】今年春运期间,在央视综合频道《晚间新闻》栏目中,一则名为“据说春运”的专题报道引发观众好评如潮。随着HTML5的异军突起,数据新闻的表现形式越发多样化。而从2009年开始,包括英国《卫报》、财新传媒在内的国内外媒体已先后组建了数据新闻团队,可视化新闻已经从“配角”变为“主角”,从“噱头”变为“看头”。
主持人:与传统新闻相比,大数据新闻有何特色?
郭俊义:对大数据的采集和挖掘,为新闻报道开辟了一个全新的领域。从新闻报道的内容来说,传统的新闻报道是需要有记者去实地采访,形成文字稿,或者视频片,然后再经过编辑后期的加工才能出来。但是大数据新闻基本不需要用传统的采访方式,它通过跟拥有大数据源或者大数据挖掘技术的互联网公司合作,就能从中挖掘出新闻。另外从新闻报道的表现方式来看,大数据新闻是通过可视化的方式来呈现,这些可视化手段让以往单调和抽象的数据更易被受众接受。
沈浩:我们身处移动互联网时代,每个人的上网行为,比如购物、社交、看新闻、出行等数据都可以被实时抓取,这些都为大数据新闻提供了丰富的新闻素材。此外,相比于传统新闻报道,大数据新闻更加善于抓住每个个体,比如像今日头条,它能更多地为每个个体进行新闻的“私人定制”,实现点对点的传播,而不再是传统的点对面的新闻传播。
喻国明:传统的新闻报道本身有它自身的价值,它对个体的观察,对现场的描述等都是它的长处,但有限的样本调查报道会影响新闻报道的客观性。比如说一个政策公布之后,一名记者如果用传统的方式,去走访一些他认为比较有代表性的采访者,例如教师、干部、群众、工人、农民等等,把他们的意见采集到一起进行整理,并认为这样就很有代表性了,能够反映各界人士的心声。但其实这样的采访方式由于带有太多的主观因素,得出的结论很容易产生偏差。大数据新闻报道则基于对大量庞杂数据的分析,样本会更加全面,使报道结果能相对客观一些。
数据一定不会说谎吗?
【背景】在当今互联网普及的社会中,几乎每一个人都会和统计数字接触,但有时貌似精确的统计数字在被人利用后,也会成为迷惑他人的工具。美国统计学家达莱尔·哈夫的《统计数字会撒谎》一书被中国网友称作“数据打假手册”,他在书中建议,在看到统计数字后,你应当首先问自己5个问题:“谁说的”“他是如何知道的”“遗漏了什么”“是否有人偷换了概念”“这个资料有意义吗”。
主持人:相比于传统的新闻报道,大数据新闻在样本选择上要庞大得多,这是否意味着大数据新闻报道一定比传统新闻报道更加客观?
郭俊义:与传统新闻一样,大数据新闻报道同样面对新闻的真实性、规范性等新闻伦理的问题。甚至在一些大数据新闻报道中,也需要用传统的新闻报道介入以核实信息的准确性。比如我们在《据说春运》的制作过程中,有一期百度大数据显示,从成都流向北京的人流量非常大,但按常理说,过年人流都是从大城市流向中小城市的,于是我们立即请成都站的记者去实地进行采访和拍摄,结果发现车上很多都是老年人,原来他们是从成都出发去北京的孩子身边过年。
喻国明:并不是所有的数据新闻都是准确客观的。数据新闻在制作的过程中会有指标选择、样本采集、分析方法、表述方式等一系列步骤,在此过程中都会面临一些主观因素的干扰。
沈浩:在大数据研究中有一个词叫作“脏数据”。比如在社交网络上存在大量的“水军”,通过“注水”发帖来扰乱网民的真实想法。那我们在研究中如果使用了因此而得来的数据,就会造成数据分析结果的偏差。
能否成为常规报道方式?
【背景】9月5日,国务院印发《促进大数据发展行动纲要》,其中指出,到2018年底前,建成国家政府数据统一开放平台,率先在信用、交通、医疗、卫生、就业、社保、地理、文化等重要领域实现公共数据资源合理适度向社会开放。2020年底前,逐步实现信用、交通、医疗等民生保障服务相关领域的政府数据集向社会开放。
喻国明:大数据新闻报道目前还处于起步阶段,面临很多挑战。第一是大数据的来源是受限制的,一些政府的统计数据,尤其是涉及民生的,目前很多都没有开放给公众。第二是数据来源的单一性,大数据不仅仅是数据的规模大、量大,大数据信息还涉及品类的多样性,比如你要研究人的社会活动,那你不仅仅是要看他的交往数据,而且最好还能看到他的购买数据等等。可以说,全世界到目前为止,针对大数据新闻报道,并没有找到一个完整、统一的规范和彻底的解决方案。
郭俊义:大数据新闻在未来会有越来越多的用武之地,特别是在很多跟民生密切相关的领域。比如上海外滩踩踏事故中的调查报告提到,当天执勤的民警曾经用肉眼看到过人流量过于密集,后来我在想,如果我们当时能有一个人流量的数据流动图,或许以后再遇到此类状况就能避免悲剧的发生。事后我找到腾讯公司,跟他们要到了当天在外滩的人流量数据图,并且对比事故发生的前一天和后一天,做了一个GIF人流量变化的动图,对比非常明显。如果以后的媒体能更多地跟大数据公司合作,会更好地彰显新闻的服务功能。
沈浩:新学期开学我们迎来了中国传媒大学第一届数据新闻专业的学生,这些新生在未来4年除了要学习传统的新闻知识,还要学习统计、编程、数据可视化制作等针对数据新闻的专业知识。其实放眼全球,必备的统计、编程、制图技能已经成为优秀记者的“标配”,这是一个未来的发展趋势。其实我们两年前就已经在校内开设了针对大二学生的数据新闻的实验班,虽然他们明年才正式毕业,但已经被很多媒体提前预订,这证明这类人才非常有市场。
CDA学员免费下载查看报告全文:2026全球数智化人才指数报告【CDA数据科学研究院】.pdf
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在中介效应分析中,人口统计学变量(如年龄、性别、学历、收入、职业等)是常见的控制变量或调节变量,其处理方式直接影响分析结 ...
2026-04-29在SQL数据库实操中,日期数据的存储与显示是高频需求,而“数字日期”(如20240520、20241231、45321)是很多开发者、数据分析师 ...
2026-04-29 很多分析师在设计标签时思路清晰,但真到落地环节却面临“数据在手,不知如何转化为可用标签”的困境:或因加工方式选择不当 ...
2026-04-29在手游行业竞争日趋白热化的当下,“流量为王”早已升级为“留存为王”,而付费用户留存率更是衡量一款手游盈利能力、运营质量的 ...
2026-04-28在日常MySQL数据库运维与开发中,经常会遇到“同一台服务器上,两个不同数据库(以下简称“源库”“目标库”)的表数据需要保持 ...
2026-04-28 很多分析师每天和数据打交道,但当被问到“标签是什么”“标签和指标有什么区别”“标签体系如何设计”时,却常常答不上来。 ...
2026-04-28箱线图(Box Plot)作为一种经典的数据可视化工具,广泛应用于统计学、数据分析、科研实证等领域,核心价值在于直观呈现数据的集 ...
2026-04-27实证分析是社会科学、自然科学、经济管理等领域开展研究的核心范式,其核心逻辑是通过对多维度数据的收集、分析与解读,揭示变量 ...
2026-04-27 很多数据分析师精通Excel函数和数据透视表,但当被问到“数据从哪里来”“表和视图有什么区别”“数据库管理系统和SQL是什么 ...
2026-04-27在大数据技术飞速迭代、数字营销竞争日趋激烈的今天,“精准触达、高效转化、成本可控”已成为企业营销的核心诉求。传统广告投放 ...
2026-04-24在游戏行业竞争白热化的当下,用户流失已成为制约游戏生命周期、影响营收增长的核心痛点。据行业报告显示,2024年移动游戏平均次 ...
2026-04-24 很多业务负责人开会常说“我们要数据驱动”,最后却变成“看哪张报表数据多就用哪个”,往往因为缺乏一套结构性的方法去搭建 ...
2026-04-24在Power BI数据可视化分析中,切片器是连接用户与数据的核心交互工具,其核心价值在于帮助使用者快速筛选目标数据、聚焦分析重点 ...
2026-04-23以数为据,以析促优——数据分析结果指导临床技术改进的实践路径 临床技术是医疗服务的核心载体,其水平直接决定患者诊疗效果、 ...
2026-04-23很多数据分析师每天盯着GMV、DAU、转化率,但当被问到“哪些指标是所有企业都需要的”“哪些指标是因行业而异的”“北极星指标和 ...
2026-04-23近日,由 CDA 数据科学研究院重磅发布的《2026 全球数智化人才指数报告》,被中国教育科学研究院官方账号正式收录, ...
2026-04-22在数字化时代,客户每一次点击、浏览、下单、咨询等行为,都在传递其潜在需求与决策倾向——这些按时间顺序串联的行为轨迹,构成 ...
2026-04-22数据是数据分析、建模与业务决策的核心基石,而“数据清洗”作为数据预处理的核心环节,是打通数据从“原始杂乱”到“干净可用” ...
2026-04-22 很多数据分析师每天盯着GMV、转化率、DAU等数字看,但当被问到“什么是指标”“指标和维度有什么区别”“如何搭建一套完整的 ...
2026-04-22在数据分析与业务决策中,数据并非静止不变的数值,而是始终处于动态波动之中——股市收盘价的每日涨跌、企业月度销售额的起伏、 ...
2026-04-21