数据挖掘80道单选题题,敢不敢来自测!(2)
21.熵是为消除不确定性所需要获得的信息量,投掷均匀正六面体骰子的熵是:(B)A1比特B2.6比特C...
21. 熵是为消除不确定性所需要获得的信息量,投掷均匀正六面体骰子的熵是: (B)
A 1比特
B 2.6比特
C 3.2比特
D 3.8比特
22. 假设属性income的最大最小值分别是12000元和98000元。利用最大最小规范化的方法将属性的值映射到0至1的范围内。对属性income的73600元将被转化为:(D)
A 0.821
B 1.224
C 1.458
D 0.716
23.假定用于分析的数据包含属性age。数据元组中age的值如下(按递增序):13,15,16,16,19,20,20,21,22,22,25,25,25,30,33,33,35,35,36,40,45,46,52,70, 问题:使用按箱平均值平滑方法对上述数据进行平滑,箱的深度为3。第二个箱子值为:(A)
A 18.3
B 22.6
C 26.8
D 27.9
24. 考虑值集{12 24 33 2 4 55 68 26},其四分位数极差是:(A)
A 31
B 24
C 55
D 3
25. 一所大学内的各年纪人数分别为:一年级200人,二年级160人,三年级130人,四年级110人。则年级属性的众数是: (A)
A 一年级
B二年级
C 三年级
D 四年级
26. 下列哪个不是专门用于可视化时间空间数据的技术: (B)
A 等高线图
B 饼图
C 曲面图
D 矢量场图
27. 在抽样方法中,当合适的样本容量很难确定时,可以使用的抽样方法是: (D)
A 有放回的简单随机抽样
B 无放回的简单随机抽样
C 分层抽样
D 渐进抽样
28. 数据仓库是随着时间变化的,下面的描述不正确的是 (C)
A. 数据仓库随时间的变化不断增加新的数据内容;
B. 捕捉到的新数据会覆盖原来的快照;
C. 数据仓库随事件变化不断删去旧的数据内容;
D. 数据仓库中包含大量的综合数据,这些综合数据会随着时间的变化不断地进行重新综合.
29. 关于基本数据的元数据是指: (D)
A. 基本元数据与数据源,数据仓库,数据集市和应用程序等结构相关的信息;
B. 基本元数据包括与企业相关的管理方面的数据和信息;
C. 基本元数据包括日志文件和简历执行处理的时序调度信息;
D. 基本元数据包括关于装载和更新处理,分析处理以及管理方面的信息
30. 下面关于数据粒度的描述不正确的是: (C)
A. 粒度是指数据仓库小数据单元的详细程度和级别;
B. 数据越详细,粒度就越小,级别也就越高;
C. 数据综合度越高,粒度也就越大,级别也就越高;
D. 粒度的具体划分将直接影响数据仓库中的数据量以及查询质量.
31. 有关数据仓库的开发特点,不正确的描述是: (A)
A. 数据仓库开发要从数据出发;
B. 数据仓库使用的需求在开发出去就要明确;
C. 数据仓库的开发是一个不断循环的过程,是启发式的开发;
D. 在数据仓库环境中,并不存在操作型环境中所固定的和较确切的处理流,数据仓库中数据分析和处理更灵活,且没有固定的模式
32. 在有关数据仓库测试,下列说法不正确的是: (D)
A. 在完成数据仓库的实施过程中,需要对数据仓库进行各种测试.测试工作中要包括单元测试和系统测试.
B. 当数据仓库的每个单独组件完成后,就需要对他们进行单元测试.
C. 系统的集成测试需要对数据仓库的所有组件进行大量的功能测试和回归测试.
D. 在测试之前没必要制定详细的测试计划.
33. OLAP技术的核心是: (D)
A. 在线性;
B. 对用户的快速响应;
C. 互操作性.
D. 多维分析;
34. 关于OLAP的特性,下面正确的是: (D)
(1)快速性 (2)可分析性 (3)多维性 (4)信息性 (5)共享性
A. (1) (2) (3)
B. (2) (3) (4)
C. (1) (2) (3) (4)
D. (1) (2) (3) (4) (5)
35. 关于OLAP和OLTP的区别描述,不正确的是: (C)
A. OLAP主要是关于如何理解聚集的大量不同的数据.它与OTAP应用程序不同.
B. 与OLAP应用程序不同,OLTP应用程序包含大量相对简单的事务.
C. OLAP的特点在于事务量大,但事务内容比较简单且重复率高.
D. OLAP是以数据仓库为基础的,但其最终数据来源与OLTP一样均来自底层的数据库系统,两者面对的用户是相同的.
36. OLAM技术一般简称为”数据联机分析挖掘”,下面说法正确的是: (D)
A. OLAP和OLAM都基于客户机/服务器模式,只有后者有与用户的交互性;
B. 由于OLAM的立方体和用于OLAP的立方体有本质的区别.
C. 基于WEB的OLAM是WEB技术与OLAM技术的结合.
D. OLAM服务器通过用户图形借口接收用户的分析指令,在元数据的知道下,对超级立方体作一定的操作.
37. 关于OLAP和OLTP的说法,下列不正确的是: (A)
A. OLAP事务量大,但事务内容比较简单且重复率高.
B. OLAP的最终数据来源与OLTP不一样.
C. OLTP面对的是决策人员和高层管理人员.
D. OLTP以应用为核心,是应用驱动的.
38. 设X={1,2,3}是频繁项集,则可由X产生__(C)__个关联规则。
A、4
B、5
C、6
D、7
40. 概念分层图是__(B)__图。
A、无向无环
B、有向无环
C、有向有环
D、无向有环
本订阅号(数据小知识分享)
关注 统计师
微信扫一扫关注公众号