【多选题】收集原始数据的主要方法包括()。A. 观察法B. 实验法C. 调查法D. 回归分析法
在数据分析领域,有一个很经典的案例,那就是“啤酒+尿布”的故事。这里体现了什么思维? A. 回归分析B. 对比思维C. 相关思维D. 远近度思维
[单选] 经过编排、加工处理的数据称为()。A . 二手数据B . 一手资料C . 原始资料D . 信息数据
将企业按资产总额分组,使用的分组形式为( )。A. 单项式分组B. 组距式分组C. 既可以是单项式分组,又可以是组距式分组D. 以上均不对
系统评价一定要包含meta分析。A. 对 B. 错
1.单选题1.1 若总体X的期望E(X)=μ,方差D(X)=σ²未知,X_(1),X_(2),...,X_(n)是来自总体的样本,则下列随机变量中不能作为统计量的是()bigcircoverline(x)=(1)/(4)sum_(i=1)^4X_(i)bigcirc X_(1)+X_(4)-2mubigcirc(1)/(sigma^2)sum_(i=1)^4(X_(i)-overline(X))^2bigcirc(1)/(3)sum_(i=1)^4(X_(i)-overline(X))^2
数据清洗是量化策略开发过程中不可缺少的一个环节,其结果质量直接关系到策略回测的准确度。因此,在数据分析之前,研究员往往会花费大量的时间来进行数据清洗工作。以下数据清洗的做法,不正确的有( )。A.数据录入过程,数据整合过程都可能会产生重复数据,可以直接删除B.Pandas中可以使用fillan方法替换缺失值数据C.对于数据中的离群值,不予处理D."3"和3是同一个值
统计学习题求解 四、计算题 1. 一个电视节目主持人想了解观众对某个电视专题的喜欢程度,他选取了1000个观众作样本,结果发现喜欢该节目的有750人。试以95.45%的概率估计观众喜欢这一专题节目的区间范围。(t=2) 2. 某公司所属40家企业的销售资料如下 年销售额(万元) 企业数 10万元以下 4 10-20 6 20-30 20 30-40 8 40万元以上 2 合计 40 计算: (1)该公司平均的销售额及标准差。 (2)如果已知另一家集团公司所属企业的平均销售额是25万元,标准差10.5万元,那么哪家集团企业内部的销售业绩比较均匀。 3. 某地2001-2009年国内生产总值的资料如表所示。试建立直线趋势预测模型,用最小平方法求解参数,并预测该地区2010年国内生产总值(GDP)。 某地2001-2009年国内生产总值 单位:亿元 年份 2001 2002 2003 2004 2005 2006 2007 2008 2009 GDP 50 56 59 64 68 72 77 81 86
217.2024年春运期间,宁波交警共检查长途客车超1.5万辆次,旅游包车2300多辆次,面包车近1.2万辆次,危化品车6600多辆次。A. 正确B. 错误
据某市场调查公司对某市80名随机受访的购房者的调查得到了该市购房者中本地人购房比率p的区间估计,在置信水平为10%下,其允许误差E=。则:(1)这80名受访者样本中为本地购房者的比率是多少(2)若显著性水平为95%,则要保持同样的精度进行区间估计,需要调查多少名购房者。
热门问题
48皮尔逊相关系数的取值范围为0到正无穷。()A. 错误B. 正确
5.聚类分析可以看作是一种非监督的分类。()
关于样本中某一变量的综合描述叫( )A. 统计值B. 平均值C. 估计值D. 参数值
下列哪项属于常见的池化方式。() A. 反向传播B. 方差池化C. 协方差池化D. 最大池化
聚类分析的常见应用领域不包括( )数据分析图像处理客户分割发现关联购买行为
决策树算法常用的划分准则包括: A. 信息增益B. 基尼指数C. 误差平方和D. 均方差
以下几种数据挖掘功能中,〔〕被广泛的用于购物篮分析.A. 关联分析B. 分类和预测C. 聚类分析D. 演变分析
区群谬误是用个体调查(分析)单位做资料收集与分析,却用集群乃至总体调查(分析)单位做结论。()A. 正确B. 错误
可以从最小化每个类簇的方差这一视角来解释K均值聚类的结果,下面对这一视角描述正确的 A. 每个样本数据分别归属于与其距离最远的聚类质心所在聚类集合B. 每个簇类的质心累加起来最小C. 最终聚类结果中每个聚类集合中所包含数据呈现出来差异性最大D. 每个簇类的方差累加起来最小
下列说法不正确的是() A. 协方差数值上等于各个数据与样本方差之差的平方和B. 协方差和方差的计算完全一致C. 协方差描述了两个变量之间的相关程度D. 方差描述了样本数据的波动程度
下列关于回归分析的描述不正确的是()A. 回归分析研究单个变量的变化情况B. 刻画不同变量之间关系的模型统称为线性回归模型C. 回归分析研究不同变量之间存在的关系D. 回归分析模型可分为线性回归模型和非线性回归模型
下列哪项属于常见的池化方式。()A. 反向传播B. 最大池化C. 方差池化D. 协方差池化
皮尔逊相关系数的取值范围为0到正无穷。()A. 正确B. 错误
下列关于回归分析的描述不正确的是()A. 回归分析模型可分为线性回归模型和非线性回归模型B. 回归分析研究不同变量之间存在的关系()C. 刻画不同变量之间关系的模型统称为线性回归模型D. 回归分析研究单个变量的变化情况
假定用于分析的数据包含属性age.数据元组[1]中age的值如下(按递增序):13,15,16,16,19,20,20,21,22,22,25,25,25,30,33,33,35,35,36,40,45,46,52,70, 问题:使用按箱平均值平滑方法对上述数据进行平滑,箱的深度为3。第二个箱子值为:A. 18.3B. 22。6C. 26。8D. 27。9
下列说法正确的是() A. 方差数值上等于各个数据与样本方差之差的平方和之平均数B. 协方差和方差的计算方式完全一致C. 协方差衡量了多个变量的分布D. 方差描述了样本数据的波动程度
下列哪项属于常见的池化方式。()A. 协方差池化B. 方差池化C. 反向传播D. 最大池化
从总体中抽取的、对总体有一定代表性的一部分个体称为()A. 总体B. 部分C. 样本D. 取样
下列说法正确的是() A. 方差数值上等于各个数据与样本方差之差的平方和之平均数B. 协方差衡量了多个变量的分布C. 协方差和方差的计算方式完全一致D. 方差描述了样本数据的波动程度
1. 名词解释 假设检验 (请在答题纸上手写并拍照上传)