简答题DBSCAN算法属于什么类型的聚类算法 A、划分型聚类算法 B、基于密度的聚类算法 C、层次聚类算法 D、网格聚类算法简答题两个随机变量X 与 Y 之间正相关,则其相关系数大于0. A、正确 B、错误简答题已知有一组数据:64、65、67、70、71、75、76、77、78、80、81、85、90该组数据样本的方差为: A、60.4 B、63.5 C、70.2 D、71.5简答题聚类分析属于有监督学习类型 A、正确 B、错误简答题有下列一组符号数据,根据信息熵的定义,求出其信息熵为:( )。(取小数点后3位)。 high normal high high normal normal normal high normal normal简答题设x、y为向量 (1)x=(1,1,2,2) (2)y=(2,2,2,3) 求两个向量的Pearson相关系数: A、0.524 B、0.561 C、0.577 D、0.512简答题正面是一组数据的偏态图示,则其偏度(Skewness)大于0. A、正确 B、错误简答题有以下一组数据:78、80、81、85、90、64、65、67、70、71、75、76、77 该组数据样本的中位数为: A、75 B、76 C、77 D、65简答题ID3算法在进行某个节点进行划分时,会偏向于取值较多的属性 A、正确 B、错误简答题变量的不确定性越大,信息熵也就越大 A、正确 B、错误简答题好的聚类方法需要产生高质量的聚类结果,所形成的簇要有高的内部相异性。 A、正确 B、错误简答题以下哪一项属于k-means算法的优点 A、不必事先知道划分为几个簇 B、可以处理噪声和离群点 C、可以发现非凸形状的簇 D、效率较高简答题聚类质量Compactness(紧密性)指标以簇内误差的( )作为度量标准简答题决策树算法ID3基于( )作为属性选择的度量。 A、信息增益比 B、信息增益 C、基尼指数 D、数据分散度