12个案例玩转机器学习【CDA三级认证考试往期实操项目原题】-CDA数据分析师官网

12个案例玩转机器学习【CDA三级认证考试往期实操项目原题】

2023-10-11

【专家讲师】

李御玺 (Yue-Shi Lee),国立台湾大学计算机工程博士，铭传大学计算机工程学系教授兼系主任暨所长，铭传大学数据挖掘中心主任，厦门大学数据挖掘中心顾问，中国人民大学数据挖掘中心顾问。其研究领域专注于数据仓库、数据挖掘、与文本挖掘。

在其相关研究领域已发表超过260篇以上的研究论文,同时也是国科会与教育部多个相关研究计划的主持人。服务过的客户包括：中国工商局、中信银行、台新银行、联邦银行、新光银行、新竹国际商业银行(现已并入渣打银行)、第一银行、永丰银行、远东银行、美商大都会人寿、嘉义基督教医院、台湾微软、零售业如赫莲娜(Helena Rubinstein)化妆品公司、特立和乐(HOLA)公司、航空公司如东方航空公司、中华航空公司、汽车行业如福特(Ford)汽车公司；政府行业如国税局等。

【课程大纲】

第一天进阶机器学习技术(半监督式学习、利润最大化学习、目标类别不平衡学习、集成学习)及实操案例分享

传统模型评估方法与利润最大化评估方法
增益图与利润图

案例一：利润最大化模型实作: 以产品营销模型为例 (2018/12考题)

目标类别不平衡的问题
目标类别不平衡的处理方式

案例二：目标类别不平衡模型实作: 找出有资金需求的中小企业借贷户并销售其贷款产品 (2019/12考题)

传统监督学习方法与非监督学习方法
半监督学习方法概述

案例三：半监督学习模型实作: 以电信业客户流失模型为例 (2019/6考题)

传统学习与集成学习
集成学习的分类：模型融合与机器学习元算法

案例四：集成学习方法实作与比较: 从租赁特征、房源特征、房主特征、位置特征、以及声誉特征的信息，预测共享住宿的日租价格 (2022/9考题)

第二天英文文本分析技术、Hugging Face经典英文模型使用及实操案例分享

文本分析简介及文本分析流程
英文文本数据预处理方法 (词性标注、字根还原、停用词处理、关键词撷取、词袋模型)

案例五：英文文本分析模型实作: 从贴文的信息中预测此贴文是否能获得高响应 (2021/3)
案例六：英文文本分析模型实作: 从贴文的短信息中识别此贴文的情绪 (2021/6)
案例七：英文文本分析模型实作: 从使用者过去的观影行为、电影名称以及电影剧情描述的信息，预测使用者对电影的评分 (2022/06)
案例八：英文文本分析模型实作: 从产品描述的信息中，预测产品类别 (2022/12)

Hugging Face经典英文语言模型使用并与传统机器学习模型比较

第三天中文文本分析技术、Hugging Face经典中文模型使用及实操案例分享

中文文本数据预处理方法 (分词、词性标注、停用词处理、关键词撷取、词嵌入模型)

案例九：中文文本分析模型实作: 从产品的消费者评论中识别此评论的情绪是正评或负评 (2021/09)
案例十：中文文本分析模型实作: 从评论信息中识别此评论是否为不当的评论 (2021/12)
案例十一：中文文本分析模型实作: 从产品的图片及产品的描述信息中，预测哪些是相同的产品 (2023/03)
案例十二：中文文本分析模型实作: 从文章的描述信息中，预测此文章是否由AI所产生出来的 (2023/06)

Hugging Face经典中文语言模型使用并与传统机器学习模型比较

【课程收益】

透过本课程的培训，上课学员应具备以下能力：
(1) 掌握利润最大化学习技术，并应用于产品营销模型的建置；
(2) 掌握目标类别不平衡学习技术，并应用于银行贷款模型的建置；
(3) 掌握半监督式机器学习技术，并应用于电信客户流失模型的建置；
(4) 掌握并实现集成学习技术，并应用于共享住宿日租价格模型的建置；
(5) 掌握英文文本分析的流程及预处理技术；

(6) 实作社群网站的英文贴文响应分析模型；

(7) 实作社群网站的英文贴文情绪分析模型；

(8) 实作电影网站的电影评分模型；
(9) 实作产品分类预测模型；
(10) 运用Hugging Face的大型英文预训练语言模型解决英文文本分析的问题；

(11) 掌握中文文本分析的流程及预处理技术；

(12)实作消费者评论的情绪分析模型；
(13) 实作不当评论的分析模型；
(14) 实作从产品的图片及产品的描述信息，预测相同产品的分析模型；
(15) 实作AI文章鉴识预测模型；
(16) 运用Hugging Face的大型中文预训练语言模型解决中文文本分析的问题；

【课程特色】

1.课程案例涵盖多个领域：课程案例涵盖了产品营销、中小企业借贷、电信业客户流失、共享住宿价格预测等多个领域，使学员能够应对不同领域的实际问题，并灵活运用机器学习技术解决挑战。2.强调文本分析技术：课程特别关注英文和中文文本分析技术，学员将学习英文和中文文本数据的预处理方法、情感分析、关键词提取等技术，培养学员在文本数据处理方面的专业能力。3.结合Hugging Face经典模型：课程将介绍Hugging Face经典英文和中文语言模型的使用，并与传统机器学习模型进行比较。学员将了解最新的自然语言处理技术，并能够评估和选择适合的模型来解决实际问题。

【课程对象】

1.机器学习从业人员：对机器学习有一定基础的从业人员，希望进一步深入学习和应用进阶技术的专业人士。2.数据分析师：希望扩展文本分析技术和应用范围，提升在文本数据处理和解决方案设计方面的能力的数据分析师。3.业务决策者：希望了解机器学习在实际业务中的应用，掌握评估模型效果和选择合适模型的知识，以指导业务决策的管理者。其他对机器学习和文本分析感兴趣的学习者：对机器学习和文本分析技术感兴趣的学生、研究人员或爱好者，希望通过该课程系统学习相关知识和技能。

【课程时间】2023年8月25日-27日

【课程收费】

面授4200元/人，远程直播3600元/人。（CDA持证人会员、全日制在读本科、研究生享九折优惠）
【课程方式】北京西直门中坤大厦/线上直播

【授课时间】

上午 9：00-12：00，下午13：30-16：30。

【其他安排】

1.报名即可获取课程案例数据集2.获取python数据分析视频预习课程3.面授同学课程第二天组织晚宴讨论4.课程录播视频有效期一年

详情咨询客服老师

机器学习特征集成学习半监督监督学习数据挖掘数据分析半监督学习

数据分析咨询请扫描二维码

上一篇CDA 认证考试速问速答

下一篇CDA持证人会员线下见面会-南京站

12个案例玩转机器学习【CDA三级认证考试往期实操项目原题】

考试指南

报考指南

热门栏目

最新资讯

政府、国央企、科研单位——中国航信-面向测试度量 ...

CDA内训丨深圳迈瑞生物医疗数据分析统计思维培训 ...

CDA数据分析师应合肥阳光新能源科技有限公司邀约开 ...

CDA走进海尔大学

苏州中行&CDA数据分析师开展数据分析师培训 ...

中国银行江苏分行-大数据应用培训

浙江农信数据建模及案例应用培训

华夏银行信用卡中心-机器学习培训

字节跳动-CDA案例实操及行业分析

长沙银行-Python集训营

数据分析在业务中的三大应用场景

AI提示词的使用方法详解及示例

CDA立足未来职场，拓展前沿视野

CDA 塑造未来职涯：构筑未来职业发展的数字基石 ...

随机森林（Random Forest）算法的优点和缺点都有哪 ...

方差分析的基本思想和原理是什么？

发现了一个好用到爆的数据分析利器

自从搞懂了回调函数，我对Python的理解上了一个台阶 ...

2020在学硕士达300万，失去学历光环的新生代何去何 ...

缓解就业焦虑的利器，证书真的越多越有保障吗？ ...