C4.5算法相较于ID3算法的主要改进在于引入了以下哪一个指标A. 信息增益B. 卡方检验C. 误分类率D. 基尼系数E. 信息增益比
设随机变量X和Y有如下的分布律-|||-Y 0 1 X -1 0 1-|||-P 0.5 0.5 P 0.25 0.5 0.25-|||-且 (XY=0)=1-|||-(1)求X和Y的联合分布律;-|||-(2)判断X和Y是否相互独立?为什么?-|||-(3) =1 条件下,求Y的条件分布律和 =0 条件下,求X的条件分布律。
设随机变量X~N(-3,1),Y~N(2,1),且X和Y相互独立,设随机变量Z=X-2Y+7,则Z服从( )A. N(0,5)B. N(0,-3)C. N(0,46)D. N(0,54)
11.判断题设总体X的数学期望为μ,X_(1),X_(2),...,X_(n)为来自X的样本,则X_(1)是μ的无偏估计。A. 对B. 错
以下哪项不是统计学在人工智能领域的应用?A. 深度学习B. 数据处理C. 机械设计D. 模型构建
描述正态分布的变异程度,用下列哪个指标表示较好()A. 标准差B. 全距C. 四分位数间距D. 变异系数
6.填空题总体的期望μ是未知的,X₁,…,Xₙ是一个样本,如果两个统计量(X_(1)+aX_(2)+X_(3))/(4)和(bX_(1)+X_(2)+X_(3))/(6)都是a的无偏估计,那么a等于____,b等于____,这两个无偏估计当中比较有效的是_____(最后一空选填“前者”或“后者”)
缺失值的产生原因不包含()A. 数据存储失败,存储器损坏;B. 机械故障导致未能收集数据;C. 主观失误、历史局限或有意隐瞒造成的数据缺失;D. 使用特征工程简化数据信息;
填空题 (3./分)-|||-20.设随机变量X与Y相互独立,且 sim B(100,0.1) ,-|||-.sim P(2) ,则 D(2X-3Y)=
在假设检验中,H_0与H_1分别表示原假设与备择假设,通常所称'犯第一类错误'是指()。A. H_1为真时,接受H_0B. H_0为不真时,接受H_1C. H_0为真时,接受H_1D. H_1不真时,接受H_0
热门问题
重测信度用重测相关系数来表示,相关系数越趋近于下列哪一数值时,则重测信度越高A. 1B. 0.7C. 2D. 3
{15分)常规情况下,下列不属于人口学变量的是A. 民族B. 收入C. 年龄D. 睡眠时间E. 性别
像从性不好的资料是()A. 由于死亡或者其他原因不能继续试验B. 能按照试验规定要求完成实验C. 重复参加试验D. 由于纳入标准不合格导致选择的研究对象不符合试验要求E. 能完成试验但是不能按照规定要求完成试验
下列关于回归分析的描述不正确的是()A. 回归分析模型可分为线性回归模型和非线性回归模型B. 回归分析研究不同变量之间存在的关系()C. 刻画不同变量之间关系的模型统称为线性回归模型D. 回归分析研究单个变量的变化情况
以下几种数据挖掘功能中,〔〕被广泛的用于购物篮分析.A. 关联分析B. 分类和预测C. 聚类分析D. 演变分析
{1.5分)确定研究总体和样本时,不需要考虑A. 立题依据B. 样本量C. 抽样方法D. 目标总体E. 纳入及排除标准
请你从下表中找出1~100中所有质数.并数一数一共多少个. 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 27 28 29 30 31 32 33 34 35 36 37 38 39 40 41 42 43 44 45 46 47 48 49 50 51 52 53 54 55 56 57 58 59 60 61 62 63 64 65 66 67 68 69 70 71 72 73 74 75 76 77 78 79 80 81 82 83 84 85 86 87 88 89 90 91 92 93 94 95 96 97 98 99 100
可以从最小化每个类簇的方差这一视角来解释K均值聚类的结果,下面对这一视角描述正确的A. 每个样本数据分别归属于与其距离最远的聚类质心所在聚类集合B. 每个簇类的质心累加起来最小C. 最终聚类结果中每个聚类集合中所包含数据呈现出来差异性最大D. 每个簇类的方差累加起来最小
假定用于分析的数据包含属性age.数据元组[1]中age的值如下(按递增序):13,15,16,16,19,20,20,21,22,22,25,25,25,30,33,33,35,35,36,40,45,46,52,70, 问题:使用按箱平均值平滑方法对上述数据进行平滑,箱的深度为3。第二个箱子值为:A. 18.3B. 22。6C. 26。8D. 27。9
44.2021年,我国人均预期寿命提高到了()。A. 78岁B. 79岁C. 78.2岁D. 79.2岁
48皮尔逊相关系数的取值范围为0到正无穷。()A. 错误B. 正确
2024年,我国每天大约有( )个小包裹往来于中国和世界各国之间A. 800万B. 1100万C. 1000万D. 900万
下列哪项属于常见的池化方式。()A. 反向传播B. 最大池化C. 方差池化D. 协方差池化
下列哪项属于常见的池化方式。()A. 协方差池化B. 方差池化C. 反向传播D. 最大池化
对研究对象制定明确的纳入标准和排除标准,是为了保证样本的A. 可靠性B. 可行性C. 代表性D. 合理性E. 科学性
下列说法正确的是()A. 方差数值上等于各个数据与样本方差之差的平方和之平均数B. 协方差和方差的计算方式完全一致C. 协方差衡量了多个变量的分布D. 方差描述了样本数据的波动程度
皮尔逊相关系数的取值范围为0到正无穷。()A. 正确B. 错误
下列说法正确的是()A. 方差数值上等于各个数据与样本方差之差的平方和之平均数B. 协方差衡量了多个变量的分布C. 协方差和方差的计算方式完全一致D. 方差描述了样本数据的波动程度