《数据分析专项练习题库》
《CDA数据分析认证考试模拟题库》
《企业数据分析面试题库》
CDA LEVEL Ⅱ建模分析师_模拟题:
1、答案(D)
在使用历史数据构造训练集(Train)集、验证(Validation)集和检验(Test)时,以下哪个样本量分配方案比较适合?
A.训练50%,验证0%,检验50%
B.训练100%,验证0%,检验0%
C.训练0%,验证100%,检验0%
D.训练60%,验证30%,检验10%
2、答案(A)
一个累积提升度曲线,当深度(Depth)等于0.1时,提升度为(Lift)为3.14,以下哪个解释正确?
A.根据模型预测,从最高概率到最低概率排序后,最高的前10%中发生事件的数量比随机抽样的响应率高3.14
B.选预测响应概率大于10%的样本,其发生事件的数量比随机抽样的响应率高3.14
C.根据模型预测,从最高概率到最低概率排序后,最高的前10%中预测的精确度比随机抽样高3.14
D.选预测响应概率大于10%的样本,其预测的精确度比随机抽样高3.14
3、答案(C)
在使用历史数据构造训练(Train)集、验证(Validation)集和检验(Test)集时,训练数据集的作用在于
A.用于对模型的效果进行无偏的评估
B.用于比较不同模型的预测准确度
C.用于构造预测模型
D.用于选择模型
4、答案(D)
在对历史数据集进行分区之前进行数据清洗(缺失值填补等)的缺点是什么?
A.增加了填补缺失值的时间
B.加大了处理的难度
D.无法对不同数据清理的方法进行比较,以选择最优方法
5、答案(C)
关于数据清洗(缺失值、异常值),以下哪个叙述是正确的?
A.运用验证数据集中变量的统计量对训练集中的变量进行数据清洗
B. 运用验证数据集中变量的统计量对验证集中的变量进行数据清洗
C. 运用训练数据集中变量的统计量对验证集中的变量进行数据清洗
D.以上均不对
6、答案(B)
当一个连续变量的缺失值占比在85%左右时,以下哪种方式最合理
A.直接使用该变量,不填补缺失值
B.根据是否缺失,生成指示变量,仅使用指示变量作为解释变量
C.使用多重查补的方法进行缺失值填补
D.使用中位数进行缺失值填补
7、答案(B)
构造二分类模型时,在变量粗筛阶段,以下哪个方法最适合对分类变量进行粗筛
A.相关系数
B.卡方检验
C.方差分析
D.T检验
8、答案(A)
以下哪个方法可以剔除多变量情况下的离群观测
A.变量中心标准化后的快速聚类法
B.变量取百分位秩之后的快速聚类法
C.变量取最大最小秩化后的快速聚类法
D.变量取Turkey转换后的快速聚类法
9、答案(C)
以下哪种变量筛选方法需要同时设置进出模型的变量显著度阀值
A .向前逐步法
B. 向后逐步法
C. 逐步法
D. 全子集法
10、答案(A)
以下哪个指标不能用于线性回归中的模型比较:
A.R方
B.调整R方
C.AIC
D.BIC
11、[答案B.]
将复杂的地址简化成北、中、南、东四区,是在进行?
A. 数据正规化(Normalization) B. 数据一般化(Generalization) C. 数据离散化(Discretization) D. 数据整合(Integration)
12、【答案(A)】
当类神经网络无隐藏层,输出层个数只有一个的时候,倒传递神经网络会变形成为?
A. 罗吉斯回归 B. 线性回归 C. 贝氏网络 D. 时间序列
13、[答案B.]
请问Apriori算法是用何者做项目集(Itemset)的筛选 ?
A. 最小信赖度(Minimum Confidence)
B. 最小支持度(Minimum Support)
C. 交易编号(Transaction ID)
D. 购买数量
14、[答案B.]
有一条关联规则为A → B,此规则的信心水平(confidence)为60%,则代表:
A. 买B商品的顾客中,有60%的顾客会同时购买A
B. 买A商品的顾客中,有60%的顾客会同时购买B
C. 同时购买A,B两商品的顾客,占所有顾客的60%
D. 两商品A,B在交易数据库中同时被购买的机率为60%
15、【答案(B)】
下表为一交易数据库,请问A → C 的支持度(Support)为:
A. 75% B. 50% C.100% D. 66.6%
TID |
Items Bought |
1 |
A,B,C |
2 |
A,C |
3 |
A,D |
4 |
B,E,F |
16、【答案(D)】
下表为一交易数据库,请问A → C 的信赖度(Confidence)为:
A. 75% B. 50% C.100% D. 66.6%
TID |
Items Bought |
1 |
A,B,C |
2 |
A,C |
3 |
A,D |
4 |
B,E,F |
17、[答案D.]
倒传递类神经网络的训练顺序为何?( A:调整权重; B:计算误差值; C:利用随机的权重产生输出的结果)
A. BCA B. CAB C. BAC D. CBA
18、[答案C.]
在类神经网络中计算误差值的目的为何?
A. 调整隐藏层个数
B. 调整输入值
C. 调整权重(Weight)
D. 调整真实值
19、[答案A.]
以下何者为Apriori算法所探勘出来的结果?
A. 买计算机同时会购买相关软件
B. 买打印机后过一个月会买墨水夹
C. 买计算机所获得的利益
D. 以上皆非
20、[答案D.]
如何利用「体重」以简单贝式分类(Naive Bayes)预测「性别」?
A. 选取另一条件属性
B. 无法预测
C. 将体重正规化为0~1之间
D. 将体重离散化
21、[答案B.]
Naive Bayes是属于数据挖掘中的什么方法?
A. 分群 B. 分类 C. 时间序列 D. 关联规则
22、[答案B.]
简单贝式分类(Naive Bayes)可以用来预测何种数据型态?
A. 数值 B. 类别 C. 时间 D. 以上皆是
23、[答案B.]
如何以类神经网络仿真罗吉斯回归(Logistic Regression)?
A. 输入层节点个数设定为3
B. 隐藏层节点个数设定为0
C. 输出层节点个数设定为3
D. 隐藏层节点个数设定为1
24、[答案B.]
请问以下何者属于时间序列的问题?
A. 信用卡发卡银行侦测潜在的卡奴
B. 基金经理人针对个股做出未来价格预测
C. 电信公司将人户区分为数个群体
D. 以上皆是
25、[答案D.]
小王是一个股市投资人,手上持有某公司股票,且已知该股过去历史数据如下表所示,今天为预测2/6的股价而计算该股3日移动平均,请问最近的3日移动平均值为多少?
日期 |
股价 |
2/1 |
10 |
2/2 |
12 |
2/3 |
13 |
2/4 |
16 |
2/5 |
19 |
A. 11 B. 13 C. 14 D. 16
26、[答案C.]
下列哪种分类算法的训练结果最难以被解释?
A. Naive Bayes
B. Logistic Regression
C. Neural Network
D. Decision Tree
27、[答案B.]
数据遗缺(Null Value)处理方法可分为人工填补法及自动填补法,下列哪种自动填补法可得到较准确的结果?
A. 填入一个通用的常数值,例如填入"未知/Unknown"
B. 把填遗缺值的问题当作是分类或预测的问题
C. 填入该属性的整体平均值
D. 填入该属性的整体中位数
1、(AB)
对于决策类模型、以下哪些统计量用于评价最合适?
A.错分类率
B.利润
C.ROC指标
D.SBC
2、(BD)
对于估计类模型、以下哪些统计量用于评价最合适?
A.错分类率
B.极大似然数
C.ROC统计量
D.SBC
3、(AB)
以下哪个变量转换不会改变变量原有的分布形式
A.中心标准化
B.极差标准化
C.TURKEY打分
D.百分位秩
4、(AB)
连续变量转换时,选取百分位秩而不选用最大最小秩的原因
A.避免模型在使用时,值域发生明显变化
B.避免输入变量值域变化对模型预测效果的影响
C.避免输入变量的异常值影响
D.是转换后的变量更接近正态分布
5、(BC)
构造二分类模型时,在变量粗筛阶段,以下哪两个方法最适合对连续变量进行粗筛
A.皮尔森(Pearson)相关系数
立刻扫码
看更多数据分析师认证试题
——学数据分析技能一定要了解的大厂入门券,CDA数据分析师认证证书!
CDA(数据分析师认证),与CFA相似,由国际范围内数据科学领域行业专家、学者及知名企业共同制定并修订更新,迅速发展成行业内长期而稳定的全球大数据及数据分析人才标准,具有专业化、科学化、国际化、系统化等特性。
同时,CDA全栈考试布局和认证体系已得到教育部直属中国成人教育协会及大数据专业委员会认可,并由为IBM、华为等提供全球认证服务的Pearson VUE面向全球提供灵活的考试服务。
报名方式
登录CDA认证考试官网注册报名>>点击报名
报名费用
Level Ⅰ:1200 RMB
Level Ⅱ:1700 RMB
Level Ⅲ:2000 RMB
考试地点
Level Ⅰ:中国区30+省市,70+城市,250+考场,考生可就近考场预约考试 >看看我所在的地哪里报名<
Level Ⅱ+Ⅲ:中国区30所城市,北京/上海/天津/重庆/成都/深圳/广州/济南/南京/杭州/苏州/福州/太原/武汉/长沙/西安/贵阳/郑州/南宁/昆明/乌鲁木齐/沈阳/哈尔滨/合肥/石家庄/呼和浩特/南昌/长春/大连/兰州>看看我所在的地哪里报名<
报考条件
业务数据分析师 CDA Level I >了解更多<
▷ 报考条件:无要求。
▷ 考试时间:随报随考。
建模分析师 CDA Level II >了解更多<
▷ 报考条件(满足任一即可):
1、获得CDA Level Ⅰ认证证书;
2、本科及以上学历,需从事数据分析相关工作1年以上;
3、本科以下学历,需从事数据分析相关工作2年以上。
▷ 考试时间:
一年四届 3月、6月、9月、12月的最后一个周六。
大数据分析师 CDA Level II >了解更多<
▷ 报考条件(满足任一即可):
1、获得CDA Level Ⅰ认证证书;
2、本科及以上学历,需从事数据分析相关工作1年以上;
3、本科以下学历,需从事数据分析相关工作2年以上。
▷ 考试时间:
一年四届 3月、6月、9月、12月的最后一个周六。
数据科学家 CDA Level III >了解更多<
▷ 报考条件(满足任一即可):
1、获得CDA Level Ⅱ认证证书;
2、本科及以上学历,需从事数据分析相关工作3年以上;
3、本科以下学历,需从事数据分析相关工作4年以上。
▷ 考试时间:
一年四届 3月、6月、9月、12月的最后一个周六。
(备注:数据分析相关工作不限行业,可涉及统计,数据分析,数据挖掘,数据库,数据管理,大数据架构等内容。)
——热门课程推荐:
想学习PYTHON数据分析与金融数字化转型精英训练营,您可以点击>>>“人才转型”了解课程详情;
想从事业务型数据分析师,您可以点击>>>“数据分析师”了解课程详情;
想从事大数据分析师,您可以点击>>>“大数据就业”了解课程详情;
想成为人工智能工程师,您可以点击>>>“人工智能就业”了解课程详情;
想了解Python数据分析,您可以点击>>>“Python数据分析师”了解课程详情;
想咨询互联网运营,你可以点击>>>“互联网运营就业班”了解课程详情;
数据分析咨询请扫描二维码
CDA持证人已遍布在世界范围各行各业,包括世界500强企业、顶尖科技独角兽、大型金融机构、国企事业单位、国家行政机关等等,“CDA数据分析师”人才队伍遵守着CDA职业道德准则,发挥着专业技能,已成为支撑科技发展的核心力量。 ...
2022-03-18CDA数据分析师在中国航信高科技产业园进行了面向测试度量的数据分析培训课程,培训人数近2 ...
2024-05-01CDA数据分析师走进深圳迈瑞生物医疗电子股份有限公司,在迈瑞总部展开了为期两天的培训,本次课程参训人员线上及线下近百人, ...
2024-05-01CDA数据分析师在合肥市对合肥阳光新能源科技有限公司开展了为期8天的企业内训。 合肥阳光新能源科技 ...
2024-05-01CDA数据分析师走进海尔大学,进行了《数据治理与数据中台建设的道与术》专题培训,培训现场爆满,近百人参加了此次培训。 ...
2024-05-01在中国银行苏州分行培训中心开始数据分析师培训,此次培训课程共10天内容,包括Excel、MySQL、概率论与数理统计、SPSS等内容, ...
2024-05-01从实际的业务需求出发,结合行业的典型应用特点,围绕实际的商业问题,探讨数据挖掘、机器学习模型在金融领域的应用,包括获客、信用评分、细分画像、交叉销售、反欺诈、违规识别、时序预测、运筹优化、流程挖掘九个方面,形成 ...
2024-05-01本次培训课程为线上+线下的模式,由于学员编程能力不一、部分学员没有编程基础,故提供统计学、python基 ...
2024-05-01华夏银行信用卡中心-机器学习培训 1、课程亮点 取材于业界一流企业和顶级咨询公司的行业实践;已经被证明是人人 ...
2024-05-01主 题:数据中台建设及数据分析应用主题分享 1. 数据中台市场洞察 2. 主流数据中台产品比较 3. 某企业数据中 ...
2024-05-01围绕“数据驱动”战略,全力打造我行 300 人数字化人才梯队,着力培养数字化管理人才、大数据专业团队 ...
2024-05-01在当今数据驱动的商业环境中,数据分析成为了企业决策的重要依据。通过对大量数据的收集、处理和分析,企业能够更好地理解市场 ...
2024-04-29在人工智能(AI)的世界里,提示词(Prompt)是一种强大的工具,它能够引导AI按照用户的需求产生特定的输出。本文将深入探讨AI ...
2024-04-29CDA立足未来职场,拓展前沿视野——对外经贸大学保险学院举办“三全育人大讲堂”分享行业最新动态。 ...
2024-04-294月2日,CDA数据分析师创始发起人兼协会理事长赵坚毅博士受邀在浙江万里学院举办了一场以“数字化能力在职场中的作用” ...
2024-04-29随机森林(Random Forests)现在机器学习中比较火的一个算法,是一种基于Bagging的集成学习方法,能够很好地处理分类和回归的问 ...
2022-12-23方差分析是数据分析中常用的一种统计分析方法,接下来让我们简单了解一下方差分析的基本思想和原理吧。 方差分析(Analysis ...
2022-12-23来源:关于数据分析与可视化 关于streamlit-aggrid 数据排序 表格样式的调整 数据 ...
2022-08-03作者:麦叔 定义 「把上面晦涩的概念汇成一句话就是:」 ❝ 回调函数就是一个被作为参 ...
2022-08-03现今,高学历人群日益增多,物以稀为贵的高学历光环淡去。无论本科生还是研究生,甚至博士生,求职竞争力都大不如前,就业压力越来越大。
2022-06-01