京公网安备 11010802034615号
经营许可证编号:京B2-20210330
限制你眼界的不是算法,而是你自己
现代人已经习惯通过社交网站来获取各类新闻信息。与传统媒体“你给什么我看什么”的信息获取方式不同,网络媒体为用户提供了更大的自由度,让他们可以选择自己想看的内容。由于网络信息的过载和多样,很多社交媒体也都采用了各种各样的算法来为用户推送更加个性化的新闻,让新闻更加符合每个人的口味。例如,Facebook就采取特定算法来决定用户的信息源(News Feed)里各种信息的排列顺序。
然而,很多学者担忧过度个性化的推荐会引起“回声室效应”(echo chamber):根据算法的推荐,人们逐渐接收到的都是和自己意见相似的新闻与朋友分享的信息,持不同观点的人也逐渐形成愈发封闭的小圈子。埃利·帕雷瑟(Eli Pariser) 在《过滤泡沫》 (Filter Bubble)一书中也表达了类似的忧虑:“这些个性化算法使得只有和人们的意识形态一致的信息才会被呈现,人们的视野越来越窄,可以接触到多元化信息的机会也越来越少。”对于持不同政治观点的人们来说,这样的“过滤泡沫”会让人们越来越坚持自己的政治理念,拉大不同意识形态人群之间的差距,造成社会上政治观点的两极分化和矛盾。
社交媒体的算法究竟是否限制了人们接收信息的多样性,为人们“屏蔽”了异己观点?最近,来自Facebook数据科学团队的研究者在《科学》(Science)上发表的一项研究发现,尽管Facebook的排名算法导致了一定程度的“过滤泡沫”,但人们对信息的选择更加制约了他们接受对立政治观点的可能性[1]。
“硬”内容的政治偏向
研究者将与国内新闻、政治和世界局势有关的内容定义为“硬”内容(“hard” content),而将与娱乐、体育和旅游相关的内容定义为“软”内容(“soft” content)。他们发现,大部分的硬新闻都具有明显的倾向保守主义或自由主义的趋势。通过对硬内容进行分析,研究者就可以确定分享这些新闻的用户的政治倾向。
在Facebook上,信息的流动是由人们的社交关系网决定的,朋友的政治观点很多时候也能够影响人们的观念。和很多政治博客不同,虽然在Facebook上也存在根据政治倾向抱团的现象,但朋友间仍存在意识形态上的差异。平均来说,每个Facebook用户的好友中,有23%的人和自己的政治意识形态相反。而人们接触到的他们朋友分享的信息中,平均有29.5%的信息来自于意识形态对立的一方。
排序算法有影响,个人选择更重要
研究者最为感兴趣的是,Facebook的新闻源排序算法会如何影响人们接触对立观点。经过算法排序后,人们的确更少接收到来自对立面的信息:平均有28.5%来自于意识形态相反的一方。
不过,人们对文章链接的个人选择对他们接触不同意识形态信息的影响更大。总的来说,人们点击的信息中只有24.9%的来自于对意识形态对立的一方。
从心理学角度来说,这种情况属于“自我验证偏好”(confirmation bias)。它使得人们有一种根据自己已有观点来接受和解释信息的倾向,这种倾向导致人们常固守于已有的观点。为了验证自己已有的观点,人们往往依赖于支持性的证据,并只搜索、解释和回忆与自己信念或假设一致的信息。上面研究中发现的人们只点击与自己政治立场一致的信息就是“自我验证偏好”的最好例子。
这个研究表明,人们对信息的自我选择和自我验证,可能比个性化算法更加危险。从另一个角度来说,这项研究也证明现代信息技术对人们观点的影响并没有先前人们设想的那么悲观。算法并非“过滤泡沫”的罪魁祸首,人们的自我验证偏好才是人们接触异己信息的最大障碍。但这项研究也提示我们,想要为人们提供更平衡全面的新闻信息,开发与社会信息有关的算法仍任重道远。
编者按:该研究发表后,一些反对者认为,这一研究实际是一个“这不是我们的错”(“it’s not our fault”)类型的研究,是Facebook在为自己“洗白”。有研究者指出,将算法对内容的筛选与用户自己对内容的筛选相比较,就像是“询问菜单上新添的炸薯条含有多少反式脂肪酸,然后被告知老早就售卖的汉堡中也有反式脂肪酸”,而对于研究的解读应该落在社交网络的算法是否会加剧人们的偏见上。2014年6月,Facebook发表在PNAS上的一项情绪研究也曾引起广泛争议。在这项研究中,Facebook在用户不知情的状况下,调整了他们动态消息上来自好友的帖子,以测试正面或负面信息的情绪传染力。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在统计学分析、实验研究、业务数据复盘过程中,单因素方差分析是检验自变量对因变量是否存在显著影响的核心方法。其中,两个水平 ...
2026-05-26【核心关键词】算法、客户、大数据、互联网、调优、建模、模型优化、机器学习、评分卡模型、模型开发、智能风控、业务场景、数 ...
2026-05-26 很多数据分析师写过无数个 SELECT,但当被问到“新建一张表,该如何定义字段类型来保证数据质量”“创建视图和存储物理表有 ...
2026-05-26在数据清洗、统计分析与数据质量检测工作中,箱型图(又称箱线图、Box Plot)是最直观、最高效的可视化分析工具之一。相较于柱状 ...
2026-05-25在大数据分析、数据清洗、质量管控、风险监测等领域,异常数据识别是保障数据质量、确保分析结论精准、规避业务决策失误的核心基 ...
2026-05-25 很多数据分析师精通Excel函数和透视表,但当被问到“数据从哪里来”“表和视图有什么区别”“数据库管理系统和SQL是什么关系 ...
2026-05-25数字化经营时代,企业的市场竞争早已从经验决策转向数据决策。门店营收、用户转化、产品销量、成本损耗、存量资产等所有经营行为 ...
2026-05-22在MySQL数据库日常运维、业务数据校验、数据迁移与数据清洗场景中,自增主键ID的连续性校验是一项基础且关键的工作。MySQL的Auto ...
2026-05-22 很多企业团队并非缺乏指标,而是陷入“指标失控”:仪表盘上堆满实时跳动的数据,却无法回答“当前瓶颈在哪、下一步该做什么 ...
2026-05-22【核心关键词】大数据、可视化、存储、架构、客户、离线、产品、同步、实时、数据仓库、数据分析、数据可视化、存储数据、离线 ...
2026-05-21在电商流量红利消退、公域获客成本持续走高的当下,存量用户深度挖掘已成为店铺增收增效的核心抓手。相较于付费投放获取的陌生新 ...
2026-05-21 很多数据分析师每天盯着几十个指标,但当被问到“这套指标要支撑什么业务目标”“指标之间是什么逻辑关系”“业务变化时如何 ...
2026-05-21在数据驱动决策的时代,数据质量直接决定分析结果的可靠性与准确性,而异常值作为数据清洗中的核心痛点,往往会扭曲分析结论、误 ...
2026-05-20 很多数据分析师每天盯着GMV、DAU、转化率,但当被问到“哪些指标在所有行业都适用”“哪些指标只对电商有意义”“二者如何搭 ...
2026-05-20Agent的能力边界,很大程度上取决于其掌握的Skill质量和数量。传统做法是靠人工编写和维护Skill,但这条路很快会遇到瓶颈。业务 ...
2026-05-20在统计分析中,方差分析(ANOVA)是一种常用的假设检验方法,核心用于分析“一个或多个自变量对单个因变量的影响”,广泛应用于 ...
2026-05-19 很多数据分析师每天盯着GMV、DAU、转化率,但当被问到“什么是指标”“指标和维度有什么区别”“如何定义指标值的计算规则和 ...
2026-05-19想高效备考 CDA 一级,拒绝盲目刷题、冗余学习?《CDA 一级教材知识手册》重磅来袭!以官方教材为核心,浓缩 13 章 103 个核心考 ...
2026-05-19在数据统计分析中,卡方检验是一种常用的非参数检验方法,核心用于判断两个或多个分类变量之间是否存在显著关联,广泛应用于市场 ...
2026-05-18在企业数字化转型的浪潮中,很多企业陷入了“技术堆砌”的误区——上线了ERP、CRM、BI等各类系统,积累了海量数据,却依然面临“ ...
2026-05-18