京公网安备 11010802034615号
经营许可证编号:京B2-20210330
关于情感分析,你不得不知道的11件事
近来,关于情感分析的研究一直被大家所津津乐道,然而关于这项分析方法究竟有多大的实用性,则是众说纷纭。有人认为情感分析堪比打开人类市场研究新世界大门的钥匙,而另一些人则认为,这项技术只是骗人的万灵油,甚至与占卜无异。那么,究竟谁是对的呢?
相较而言,我(笔者)更倾向于站在前者的阵营中。基于文本分析,自动情感分析技术为基于李克特量表的传统分析方法(Likert-reliant methodologies)注入了新的动力,使得研究人员能通过社群倾听技术实时掌控客户反馈的倾向变化,并由此实现了对客户心声的深入挖掘。
对于后者的阵营,我认为他们对情感分析产生质疑的原因可能来自于对这种分析方法实现能力与局限性的认识扭曲。这样的认识扭曲也许是由于某些能力不足的解决方案供应商造成的,不过不管它们究竟来自何方,我都会倾力而为去揭穿它们,还原一个有真正实际意义的情感分析技术。
我们目标是鼓励适当的使用情感分析技术并防止滥用。为了做到这点,对市场教育的呼唤十分重要,我通过会议的形式做了很多这样的事,在今年7月15号到16号的纽约情感分析研讨会上,我特地点明了这样十一件情感分析研究者必须知道的事:
1)在情感分析中,通过直接匹配词典来查找词汇是一种简单明了的方法,也但略显粗俗。词的意思往往会根据句式、语境以及上下文之间的关联而发生变化,进行情感分析时我们需要将语言学与统计学的方法都应用到其中。
2)文档层面的情感分析或许正在面临过时。我们情感分析的目标应该关注于实体(entity)、概念(concept)以及主题(topic)的层面。(例如,一部iPhone6是一个实体,iPhone是一个概念范畴,而智能手机则是它所属的主题)
3)“情感”的一般语言定义包括态度(attitude)、意见(opinion)、感觉(feelings)和情绪(emotion)。最先进的情感分析技术可以让你超越正负面倾向得分的局限,根据情绪——如快乐、惊讶、恐惧、厌恶、愤怒、悲伤等对文本情感进行评价,而不是仅仅是一个表达程度的分数。
4)请将眼界放宽:情感分析是情感计算(Affective computing)大家族的一份子,这个家族涉及到了所有与人类情感相关、来自人类情感或是对人类情感产生影响的现象计算研究。情感分析与家族中的其他伙伴皆有所联系,但在技术和方法上有着较为明显的区别。
5)并非所有的情感都是平等的。不论是情感的倾向还是强度,我们都需要努力去理解。同时,研究情感如何转化为行动也具有同样重要的意义。
6)不论你是否在项目中使用了语言工程、统计模型与机器学习方法,在很多情况下,也许针对特定领域训练合适的模型,才是模型优化的关键。
7)必须注意那些有关于准确率的说法。对于模型的准确性,这世界上不存在绝对的衡量标准,因此在度量模型的准确性时,我们总会遇到各种各样的麻烦。正因如此,有的解决方案供应商们甚至可能在提出分析模型之后对模型准确性的测量过程避而不谈。一种公认可行的准确度测量方法是将模型结果与一份经过完全精准的人工注释/分类的语料进行对比,这也意味着我们需要让人工和机器同时去进行一项庞大的语料分析工作,再进行二者匹配程度的计算。但是当你真的去尝试这样的做法时,所谓人工一方作出的判断究竟是对是错,同样也很难说明清楚。与此同时,面向不同层面的文本分析软件之间也很难进行准确度的对比,例如有些软件只做了文档层面的分析,而另一些则能够对实体和概念进行了解析,我们能说在实体层面具有70%准确率的软件就优于在文档层面具有97%准确率的软件吗?
8)文本是最常见的情感数据来源,但它并不是唯一的一个。针对视频的面部编码技术,针对音频流的语音分析,都可以用于检测人类的情绪反应,而这些也都是更先进的情感状态评估方法。而有关人类情感分析下一个前沿领域也有可能是:神经科学、可穿戴仪器开发和生理学的其他研究手段。
9)语言是人类使用的最有活力和发展最快速的工具之一。计算机技术在社会中普及给了我们前所未有的语言表现能力,众所周知的表情符号(emoji)就是这一进程中的典型例子。表情符号不仅仅是人类语言的扩音器,它在发展过程中逐渐获得了自己的语法和特殊语义,从而自然而然地如潮水般涌入广大的网络社交媒体中。对于情感分析研究者来说,我们也应该紧跟时代发展的脚步,去针对各种新诞生的语言表达形式进行相关的挖掘与研究。
10)通过将行为表现与情感分析模型进行联系,或是根据人口与文化范畴对语料进行分类,能够帮助你提升分析与预测的能力。当你面对庞杂的大规模数据时,请毫不犹豫地运用这个方法。
11)一些先进的概念,如动机、影响、维护和催化,都是建立在对人类情感和行为进行建模以及社群网络分析的基础上的。在数据咨询行业,研究的最主要目标是对市场以及消费者进行解析,而这种解析的最终目标则是创造使消费者“行动起来”的条件。作为情感分析研究者,你需要面向上述概念开展你的工作。
好了,上面便是我个人(笔者)对情感分析这些事的理解,当你在开始设计下一项有关的调查研究时,或是当你不知道如何将社交媒体挖掘应用到你的研究中时,不妨考虑一下使用情感分析。多思考一些实际可行的情感算法也许会对你有所帮助,将它结合于行为分析或是其他先进的市场细分技术,可能会使你找到洞悉潜在客户行为的方法。总而言之,情感分析值得重视,它是绝对能够为你的市场研究带来一些令人眼前一亮的新东西的。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
主讲人简介 张冲,海归统计学硕士,CDA 认证数据分析师,前云南白药集团资深数据分析师,自媒体 Python 讲师,全网课程播放量破 ...
2026-04-10在数据可视化与业务分析中,同比分析是衡量业务发展趋势、识别周期波动的核心手段,其核心逻辑是将当前周期数据与上年同期数据进 ...
2026-04-10在机器学习模型的落地应用中,预测精度并非衡量模型可靠性的唯一标准,不确定性分析同样不可或缺。尤其是在医疗诊断、自动驾驶、 ...
2026-04-10数据本身是沉默的,唯有通过有效的呈现方式,才能让其背后的规律、趋势与价值被看见、被理解、被运用。统计制图(数据可视化)作 ...
2026-04-10在全球化深度发展的今天,跨文化传播已成为连接不同文明、促进多元共生的核心纽带,其研究核心围绕“信息传递、文化解读、意义建 ...
2026-04-09在数据可视化领域,折线图是展示时序数据、趋势变化的核心图表类型之一,其简洁的线条的能够清晰呈现数据的起伏规律。Python ECh ...
2026-04-09在数据驱动的时代,数据分析早已不是“凭经验、靠感觉”的零散操作,而是一套具备固定逻辑、标准化流程的系统方法——这就是数据 ...
2026-04-09长短期记忆网络(LSTM)作为循环神经网络(RNN)的重要改进模型,凭借其独特的门控机制(遗忘门、输入门、输出门),有效解决了 ...
2026-04-08在数据分析全流程中,数据质量是决定分析结论可靠性的核心前提,而异常值作为数据集中的“异类”,往往会干扰统计检验、模型训练 ...
2026-04-08在数字经济飞速发展的今天,数据已渗透到各行各业的核心场景,成为解读趋势、优化决策、创造价值的核心载体。而数据分析,作为挖 ...
2026-04-08在数据分析全流程中,数据处理是基础,图形可视化是核心呈现手段——前者负责将杂乱无章的原始数据转化为干净、规范、可分析的格 ...
2026-04-07在数据分析与统计推断中,p值是衡量假设检验结果显著性的核心指标,其本质是在原假设(通常为“无效应”“无差异”)成立的前提 ...
2026-04-07在数字经济深度渗透的今天,数据已成为企业生存发展的核心资产,企业的竞争本质已转变为数据利用能力的竞争。然而,大量来自生产 ...
2026-04-07Python凭借简洁的语法、丰富的生态库,成为算法开发、数据处理、机器学习等领域的首选语言。但受限于动态类型、解释性执行的特性 ...
2026-04-03在深度学习神经网络中,卷积操作是实现数据特征提取的核心引擎,更是让模型“看懂”数据、“解读”数据的关键所在。不同于传统机 ...
2026-04-03当数字化转型从企业的“战略口号”落地为“生存之战”,越来越多的企业意识到,转型的核心并非技术的堆砌,而是数据价值的深度挖 ...
2026-04-03在日常办公数据分析中,数据透视表凭借高效的汇总、分组功能,成为Excel、WPS等办公软件中最常用的数据分析工具之一。其中,“计 ...
2026-04-02在数字化交互的全场景中,用户的每一次操作都在生成动态的行为轨迹——电商用户的“浏览商品→点击详情→加入购物车”,内容APP ...
2026-04-02在数字化转型深度推进的今天,企业数据已成为驱动业务增长、构建核心竞争力的战略资产,而数据安全则是守护这份资产的“生命线” ...
2026-04-02在数据驱动决策的浪潮中,数据挖掘与数据分析是两个高频出现且极易被混淆的概念。有人将二者等同看待,认为“做数据分析就是做数 ...
2026-04-01