生物统计学(版)杜荣骞课后习题答案统计数据的收集与整理

生物统计学(版)杜荣骞课后习题答案统计数据的收集与整理
生物统计学(版)杜荣骞课后习题答案统计数据的收集与整理

第一章统计数据的收集与整理1.1 算术平均数是怎样计算的?为什么要计算平均数?

答:算数平均数由下式计算:n y

y

n

i

i

=

=1

,含义为将全部观测值相加再被观测值的个数

除,所得之商称为算术平均数。计算算数平均数的目的,是用平均数表示样本数据的集中点,或是说是样本数据的代表。

1.2 既然方差和标准差都是衡量数据变异程度的,有了方差为什么还要计算标准差?

答:标准差的单位与数据的原始单位一致,能更直观地反映数据地离散程度。

1.3 标准差是描述数据变异程度的量,变异系数也是描述数据变异程度的量,两者之间有什么不同?

答:变异系数可以说是用平均数标准化了的标准差。在比较两个平均数不同的样本时所得结果更可靠。

1.4 完整地描述一组数据需要哪几个特征数?

答:平均数、标准差、偏斜度和峭度。

1.5 下表是我国青年男子体重(kg)。由于测量精度的要求,从表面上看像是离散型数据,不要忘记,体重是通过度量得到的,属于连续型数据。根据表中所给出的数据编制频数分布表。

66 69 64 65 64 66 68 65 62 64 69 61 61 68 66 57 66 69 66 65 70 64 58 67 66 66 67 66 66 62 66 66 64 62 62 65 64 65 66 72 60 66 65 61 61 66 67 62 65 65 61 64 62 64 65 62 65 68 68 65 67 68 62 63 70 65 64 65 62 66 62 63 68 65 68 57 67 66 68 63 64 66 68 64 63 60 64 69 65 66 67 67 67 65 67 67 66 68 64 67 59 66 65 63 56 66 63 63 66 67 63 70 67 70 62 64 72 69 67 67 66 68 64 65 71 61 63 61 64 64 67 69 70 66 64 65 64 63 70 64 62 69 70 68 65 63 65 66 64 68 69 65 63 67 63 70 65 68 67 69 66 65 67 66 74 64 69 65 64 65 65 68 67 65 65 66 67 72 65 67 62 67 71 69 65 65 75 62 69 68 68 65 63 66 66 65 62 61 68 65 64 67 66 64 60 61 68 67 63 59 65 60 64 63 69 62 71 69 60 63 59 67 61 68 69 66 64 69 65 68 67 64 64 66 69 73 68 60 60 63 38 62 67 65 65 69 65 67 65 72 66 67 64 61 64 66 63 63 66 66 66 63 65 63 67 68 66 62 63 61 66 61 63 68 65 66 69 64 66 70 69 70 63 64 65 64 67 67 65 66 62 61 65 65 60 63 65 62 66 64

答:首先建立一个外部数据文件,名称和路径为:E:\data\exer1-5e.dat。所用的SAS程序和计算结果如下:

proc format;

value hfmt

56-57='56-57' 58-59='58-59' 60-61='60-61'

62-63='62-63' 64-65='64-65' 66-67='66-67'

68-69='68-69' 70-71='70-71' 72-73='72-73'

74-75='74-75';

run;

data weight;

infile 'E:\data\exer1-5e.dat';

input bw @@;

run;

proc freq;

table bw;

format bw hfmt.;

run;

The SAS System

Cumulative Cumulative

BW Frequency Percent Frequency Percent

-----------------------------------------------------

56-57 3 1.0 3 1.0

58-59 4 1.3 7 2.3

60-61 22 7.3 29 9.7

62-63 46 15.3 75 25.0

64-65 83 27.7 158 52.7

66-67 77 25.7 235 78.3

68-69 45 15.0 280 93.3

70-71 13 4.3 293 97.7

72-73 5 1.7 298 99.3

74-75 2 0.7 300 100.0

1.6 将上述我国男青年体重看作一个有限总体,用随机数字表从该总体中随机抽出含量为10的两个样本,分别计算它们的平均数和标准差并进行比较。它们的平均数相等吗?标准差相等吗?能够解释为什么吗?

答:用means过程计算,两个样本分别称为1y和2y,结果见下表:

The SAS System

Variable N Mean Std Dev

----------------------------------------

Y1 10 64.5000000 3.5039660

Y2 10 63.9000000 3.1780497

----------------------------------------

随机抽出的两个样本,它们的平均数和标准差都不相等。因为样本平均数和标准差都是统计量,统计量有自己的分布,很难得到平均数和标准差都相等的两个样本。

1.7 从一个有限总体中采用非放回式抽样,所得到的样本是简单的随机样本吗?为什么?本课程要求的样本都是随机样本,应当采用哪种抽样方法,才能获得一随机样本?

答:不是简单的随机样本。从一个有限总体中以非放回式抽样方法抽样,在前后两次抽样之间不是相互独立的,后一次的抽样结果与前一次抽样的结果有关联,因此不是随机样本。应采用随机抽样的方法抽取样本,具体说应当采用放回式抽样。

1.8 证明

()()

∑∑

==

±

='

-

=

'

-'

n

i

n

i

i

i

i

i

C

y

y

y

y

y

y

11

2

2,。

其中

若用C

y

y i

i

=

'

或i

i

Cy

y=

'

编码时,前式是否仍然相等?

答:(1)令 C y y i i ±='

则 C y y ±=' 平均数特性之③。

()()()[]

()

∑∑∑===-=±-±='-'n

i i n i i n

i i y y C y C y y y 1

2

12

12

(2) 令 C y y i

i =' 则

C y

y =

' 平均数特性之②。

()

()2

1

2

2

112

C y y C y C y

y y n

i i n

i i n

i i

∑∑∑===-=

?

?? ??-='-'

用第二种编码方式编码结果,两式不再相等。

1.9 有一个样本:n y y y ,,,21 ,设B 为其中任意一个数值。证明只有当y B =时,

()

∑=-n

i B y 1

2

最小。这是平均数的一个重要特性,在后面讲到一元线型回归时还会用到

该特性。

答:令 ()∑-=2B y p , 为求使p 达最小之B ,令()02

=?-?∑B B y

则 ()y

n y

B B y ===-∑∑02 。

1.10 检测菌肥的功效,在施有菌肥的土壤中种植小麦,成苗后测量苗高,共100株,数据如下[1]:

10.0 9.3 7.2 9.1 8.5 8.0 10.5 10.6 9.6 10.1 7.0 6.7 9.5 7.8 10.5 7.9 8.1 9.6 7.6 9.4 10.0 7.5 7.2 5.0 7.3 8.7 7.1 6.1 5.2 6.8 10.0 9.9

7.5

4.5 7.6 7.0 9.7 6.2 8.0 6.9 8.3

8.6 10.0

4.8

4.9

7.0

8.3

8.4

7.8

7.5

6.6 10.0 6.5 9.

5 8.5 11.0 9.7 6.

6 10.0 5.0

6.5 8.0 8.4 8.

3 7.

4 7.

4

8.1 7.7 7.5 7.1

7.8 7.6 8.6 6.

0 7.0 6.

4

6.7 6.3 6.4 11.0

10.5 7.8 5.0 8.

0 7.0 7.

4

5.2

6.7 9.0 8.6

4.6 6.9 3.5 6.

2 9.7 6.

4

5.8

6.4 9.3 6.4

编制苗高的频数分布表,绘制频数分布图,并计算出该样本的四个特征数。

答:首先建立一个外部数据文件,名称和路径为:E:\data\exr1-10e.dat。SAS程序及结果如下:

options nodate;

proc format;

value hfmt

3.5-

4.4='3.5-4.4' 4.5-

5.4='4.5-5.4' 5.5-

6.4='5.5-6.4'

6.5-

7.4='6.5-7.4' 7.5-

8.4='7.5-8.4' 8.5-

9.4='8.5-9.4'

9.5-10.4='9.5-10.4' 10.5-11.4='10.5-11.4';

run;

data wheat;

infile 'E:\data\exr1-10e.dat';

input height @@;

run;

proc freq;

table height;

format height hfmt.;

run;

proc capability graphics noprint;

var height;

histogram/vscale=count;

inset mean var skewness kurtosis;

run;

The SAS System

The FREQ Procedure

Cumulative Cumulative

height Frequency Percent Frequency Percent ---------------------------------------------------------------------

3.5-

4.4 1 1.00 1 1.00

4.5-

5.4 9 9.00 10 10.00

5.5-

6.4 11 11.00 21 21.00

6.5-

7.4 23 23.00 44 44.00

7.5-8.4 24 24.00 68 68.00

8.5-9.4 11 11.00 79 79.00

9.5-10.4 15 15.00 94 94.00

10.5-11.4 6 6.00 100 100.00

1.11 北太平洋宽吻海豚羟丁酸脱氢酶(HDBH)数据的接收范围频数表[2]如下:(略作调整)

HDBH数据的接收范围

频数

/(U·L-1)

<214 1

<245.909 1 3

<277.818 2 11

<309.727 3 19

<341.636 4 26

<373.545 5 22

<405.454 5 11

<437.363 6 13

<469.272 7 6

<501.181 8 3

<533.090 9 2

根据上表中的数据作出直方图。

答:以表中第一列所给出的数值为组界,直方图如下:

1.12 灵长类手掌和脚掌可以握物一侧的皮肤表面都有突起的皮肤纹嵴。纹嵴有许多特

征,这些特征在胚胎形成之后是终生不变的。人类手指尖的纹型,大致可以分为弓、箕和斗三种类型。在手指第一节的基部可以找到一个点,从该点纹嵴向三个方向辐射,这个点称为三叉点。弓形纹没有三叉点,箕形纹有一个三叉点,斗形纹有两个三叉点,记录从三叉点到箕或斗中心的纹嵴数目称为纹嵴数(finger ridge count, FRC)。将双手十个指尖的全部箕形纹的纹嵴数和/或斗形纹两个纹嵴数中较大者相加,称为总纹嵴数(total finger ridge count, TFRC)。下表给出了大理白族人群总纹嵴数的频数分布[3]:

TFRC分组中值频数

11~30 20 2

31~50 40 1

51~70 60 8

71~90 80 29

91~110 100 54

111~130 120 63

131~150 140 68

151~170 160 51

171~190 180 18

191~210 200 6

首先判断数据的类型,然后绘出样本频数分布图,计算样本的四个特征数并描述样本分布形态。

答:总纹脊数属计数数据。

计数数据的频数分布图为柱状图,频数分布图如下:

样本特征数(以TFRC的中值计算)SAS程序:

options nodate;

data tfrc;

do i=1 to 10; input y @@;

input n @@;

do j=1 to n;

output;

end;

end;

cards;

20 2

40 1

60 8

80 29

100 54

120 63

140 68

160 51

180 18

200 6

;

run;

proc means mean std skewness kurtosis;

var y;

run;

结果见下表:

The SAS System

Analysis Variable : Y

Mean Std Dev Skewness Kurtosis

------------------------------------------------------

126.5333333 32.8366112 -0.2056527 -0.0325058

------------------------------------------------------从频数分布图可以看出,该分布的众数在第七组,即总纹脊数的中值为140的那一组。分布不对称,平均数略小于众数,有些负偏。偏斜度为-0.2056527,偏斜的程度不是很明显,基本上还可以认为是对称的,峭度几乎为零。

1.13 海南粗榧叶长度的频数分布[4]:

叶长度/mm 中值频数

2.0~2.2 2.1 390

2.2~2.4 2.3 1 434

2.4~2.6 2.5 2 643

2.6~2.8 2.7 3 546

2.8~

3.0 2.9 5 692

3.0~3.2 3.1 5 187

3.2~3.4 3.3 4 333

3.4~3.6 3.5 2 767

3.6~3.8 3.7 1 677

3.8~

4.0 3.9 1 137

nag

4.0~4.2 4.1 667

4.2~4.4 4.3 346

4.4~4.6 4.5 181

绘出频数分布图,并计算偏斜度和峭度。

答:表中第一列所给出的数值为组限,下图为海南粗榧叶长度的频数分布图。

计算偏斜度和峭度的SAS程序和计算结果如下:

options nodate;

data length;

do i=1 to 13; input y @@;

input n @@;

do j=1 to n;

output;

end;

end;

cards;

2.1 390

2.3 1434

2.5 2643

2.7 3546

2.9 5692

3.1 5187

3.3 4333

3.5 2767

3.7 1677

3.9 1137

4.1 667

4.3 346

4.5 181

;

run;

proc means n skewness kurtosis;

var y;

run;

The SAS System

Analysis Variable : Y

n Skewness Kurtosis

---------------------------------

30000 0.4106458 0.0587006

---------------------------------

样本含量n=30000,是一个很大的样本,样本的偏斜度和峭度都已经很可靠了。偏斜度为0.41,有一个明显的正偏。

1.14 马边河贝氏高原鳅繁殖群体体重分布如下[5]:

体质量/g 中值雌鱼雄鱼

2.00~

3.00 2.50 1 4

3.00~

4.00 3.50 6 7

4.00~

5.00 4.50 13 11

5.00~

6.00 5.50 30 25

6.00~

7.00 6.50 25 25

7.00~8.00 7.50 16 23

8.00~9.00 8.50 21 17

9.00~10.00 9.50 18 16

10.00~11.00 10.50 12 4

11.00~12.00 11.50 3

12.00~13.00 12.50 2

首先判断数据的类型,然后分别绘制雌鱼和雄鱼的频数分布图,计算样本平均数、标准差、偏斜度和峭度并比较两者的变异程度。

答:鱼的体重为度量数据,表中第一列所给出的数值为组限。在下面的分布图中雌鱼和雄鱼的分布绘在了同一张图上,以不同的颜色表示。

计算统计量的SAS程序与前面的例题类似,这里不再给出,只给出结果。

雌鱼:

The SAS System

Analysis Variable : Y

N Mean Std Dev Skewness Kurtosis

-----------------------------------------------------------

147 7.2414966 2.1456820 0.2318337 -0.6758677

-----------------------------------------------------------

雄鱼:

The SAS System

Analysis Variable : Y

N Mean Std Dev Skewness Kurtosis

-----------------------------------------------------------

132 6.7803030 1.9233971 -0.1322816 -0.5510332

-----------------------------------------------------------

直观地看,雄鱼的平均体重低于雌鱼。雌鱼有一正偏,雄鱼有一负偏。因此,相对来说雌鱼低体重者较多,雄鱼高体重者较多。但两者都有很明显的负峭度,说明“曲线”较平坦,两

尾翘得较高。

1.15 黄胸鼠体重的频数分布[6]:

组界/g 频数

0

15

30

45

60

75

90

105

120

135

150

总数169

绘制频数分布图,从图形上看分布是对称的吗,说明什么问题?

答:下面是频数分布图:

从上图可见,图形不是对称的,有一些正偏。说明在该黄雄鼠群体中,低体重者分布数量,高于高体重者的数量。另外,似乎峭度也有些低。

1.16 25名患者入院后最初的白细胞数量(×103)[7]如下表:

8 5 12 4 11 6 8 7 7 12

7 3 11 14 11 9 6 6 5 6

10 14 4 5 5

计算白细胞数量的平均数、方差和标准差。

答:用means过程计算,程序不再给出,只给出运行结果。

The SAS System

Analysis Variable : Y

N Mean Variance Std Dev

-------------------------------------------

25 7.8400000 10.3066667 3.2103998

--------------------------------------------

1.17 细胞珠蛋白基因(CYGB)可能是非小细胞肺癌(NSCLC)的抑制基因之一。一个研究小组研究了该基因的表达、启动子甲基化和等位基因不平衡状态等,以便发现它与肿瘤发病间的关联。下面列出了其中15名患者的基因表达(肿瘤患者/正常对照,T/N),肿瘤患者与正常对照甲基化指数差(MtI T-MtI N)[8]:

样本号T/N MtI T-MtI N

357 0.014 0.419

370 0.019 0.017

367 0.035 0.105

316 0.044 0.333

369 0.054 0.170

358 0.084 0.246

303 0.111 0.242

314 0.135 0.364

308 0.236 0.051

310 0.253 0.520

341 0.264 0.200

348 0.315 0.103

323 0.359 0.167

360 0.422 0.176

336 0.442 0.037

计算以上两项指标的平均数和标准差并计算两者的变异系数,这两个变异系数可以比较吗?为什么?

答:记T/N为1y,MtI T-MtI N为2y,用means过程计算,SAS运行的结果见下表:

The SAS System

Variable N Mean Std Dev CV

------------------------------------------------------

Y1 15 0.1858000 0.1505624 81.0346471

Y2 15 0.2100000 0.1465274 69.7749634

------------------------------------------------------

两个变异系数是可以比较的,因为它们的标准差都是用平均数标准化了的,已经不存在不同单位的影响了。

生物统计学考试题及答案

重庆西南大学 2012 至 2013 学年度第 2 期 生物统计学 试题(A ) 试题使用对象: 2011 级 专业(本科) 命题人: 考试用时 120 分钟 答题方式采用: 闭卷 说明:1、答题请使用黑色或蓝色的钢笔、圆珠笔在答题纸上书写工整. 2、考生应在答题纸上答题,在此卷上答题作废. 一:判断题;(每小题1分,共10分 ) 1、正确无效假设的错误为统计假设测验的第一类错误。( ) 2、标准差为5,B 群体的标准差为12,B 群体的变异一定大于A 群体。( ) 3、一差异”是指仅允许处理不同,其它非处理因素都应保持不变。( ) 4、30位学生中有男生16位、女生14位,可推断该班男女生比例符合1∶1 (已知84.321,05.0=χ)。 ( ) 5、固定模型中所得的结论仅在于推断关于特定的处理,而随机模型中试验结论则将用于推断处理的总体。( ) 6、率百分数资料进行方差分析前,应该对资料数据作反正弦转换。( ) 7、比较前,应该先作F 测验。 ( ) 8、验中,测验统计假设H 00:μμ≥ ,对H A :μμ<0 时,显著水平为5%,则测验的αu 值为1.96( ) 9、行回归系数假设测验后,若接受H o :β=0,则表明X 、Y 两变数无相关关系。 ( ) 10、株高的平均数和标准差为30150±=±s y (厘米),果穗长的平均数和标准差为s y ±1030±=(厘米),可认为该玉米的株高性状比果穗性状变异大。 ( ) 二:选择题;(每小题2分,共10分 ) 1分别从总体方差为4和12的总体中抽取容量为4的样本,样本平均数分别为3和2,在95%置信度下总体平均数差数的置信区间为( )。 A 、[-9.32,11.32] B 、[-4.16,6.16]

哈佛大学生物统计学硕士专业有哪些优势

哈佛大学生物统计学硕士专业有哪些优势 2018年哈佛大学生物统计学硕士专业优势: 哈佛大学的生物统计学学院提供了一个无与伦比的环境,以在统计科学方面进行研究和教育,同时处于造福世界人口健康的前沿。 我们的教师是发展统计方法的领导者,用于临床试验和观察研究,研究环境,和基因组学/遗传学。 我们的毕业生拥有优秀的分析和计算能力,在学术界、行业、政府以及其他领域都有广泛的职业发展。 我们在计算生物学、定量基因组学和海量数据分析方面的创新方法在理论和应用上得到了深入的研究。 我们独特的社区在哈佛医学院、达纳-法伯癌症研究所和波士顿 的世界级医院提供了无数的资源和合作机会。 有了丰富的创新史,哈佛大学的生物统计学系为学生们提供了一个绝佳的机会,让他们加入到我们的传统中,来解决公共卫生、生 物医学研究和计算生物学方面的最大挑战。我们的项目为学生提供 了在统计理论和方法以及计算方面的严格训练,并利用他们在课堂 上学到的东西来解决现实世界中的重要问题。 2018年哈佛大学生物统计学硕士项目介绍: 生物统计学硕士项目在统计理论基本知识方面,在医学与公共卫生方面规划研究,进行分析,并撰写报告,解释科学推理数值数据 的研究中,在与科学家关于相关学科协作和有效沟通的能力方面训 练学生。应用领域包括观察性研究、临床试验、计算生物学和定量 基因组学、统计遗传学、医学和公共卫生研究等领域。 该部门提供5个科学硕士课程,每一个都是为有不同背景和目标的学生设计的。

80-creditMasterofScienceinBiostatistics 提供统计理论培训和各种统计和计算方法,用于医学和公共卫生方面的应用。本课程适合学生在完成学业或硕士阶段的医学研究工作。该计划针对的是那些正在考虑在生物统计学、统计学、生物信 息学或诸如流行病学、环境卫生或医学等相关领域的博士水平工作 的学生。SM2计划也适用于那些寻求更多样化和先进的课程的学生,但他们正在考虑硕士阶段的医学研究职位。 60-creditMasterofScienceinBiostatistics 该项目培养拥有定量本科学位的学生从事大学、医院和行业应用研究职位。这个项目除了课程,需要完成一篇论文。 42.5-creditMasterofScienceinBiostatistics 为具有数学和统计背景的学生设计,在经过一年的学习后达到熟练程度,可与80学时的项目相媲美。在一个数学科学或一个定量领 域拥有硕士学位的学生可能有资格参加一年的SM计划。 80-creditMasterofScienceinCompBio&QuantitativeGenetics 该项目与流行病学系合作,为学生提供严格的量化训练和必要的技能,以成功地应对大规模公共卫生数据(大数据)在生物医学研 究中所提出的挑战。它是一个终端专业学位,这将使你能够开启生 物信息学的职业生涯。它也可以提供生物统计学,流行病学、计算 生物学等相关领域进一步博士研究的基础。 60-creditMasterofScienceinHealthDataScience 该项目为学生提供严格的定量培训和必要的管理和分析卫生科学数据的计算技能,以解决当今在公共卫生,医学和基础生物学中最 重要的问题。

生物统计学复习题及答案

《生物统计学》复习题 一、填空题(每空1分,共10分) 1 ?变量之间的相关关系主要有两大类: (因果关系),(平行关系) 2 ?在统计学中,常见平均数主要有( 算术平均数)、(几何平均数)、(调和平均数) S 、:'(X 迁 3 ?样本标准差的计算公式( 1 n 1 ) 4 ?小概率事件原理是指( 某事件发生的概率很小,人为的认为不会发生 ) 5. 在标准正态分布中, P (- K u w 1) = (0。6826 ) (已知随机变量1的临界值为0. 1587) 6. 在分析变量之间的关系时, 一个变量X 确定,Y 是随着X 变化而变化,两变量呈因果关系, 则X 称为(自 变量),Y 称为(依变量) 二、单项选择题(每小题 1分,共20分) 1、 ________________________________ 下列数值属于参数的是: A 、总体平均数 B 、自变量 C 依变量 D 、样本平均数 2、 下面一组数据中属于计量资料的是 _____________ A 、产品合格数 B 、抽样的样品数 C 病人的治愈数 D 、产品的合格率 3、 在一组数据中,如果一个变数 10的离均差是2,那么该组数据的平均数是 _________ 4、 变异系数是衡量样本资料 _________ 程度的一个统计量。 ___________ A 、变异 B 、同一 C 集中 D 、分布 5、 方差分析适合于, ____________ 数据资料的均数假设检验。 A 、两组以上 B 、两组 C 一组 D 、任何 8、平均数是反映数据资料 _________ 性的代表值。 A 、变异性 B 、集中性 C 差异性 D 、独立性 9、在假设检验中,是以 ___________ 为前提。 A 肯定假设 B 、备择假设 C 原假设 10、抽取样本的基本首要原则是 A 12 B 、10 D 、2 6、 在t 检验时,如果t = t o 、01,此差异是: A 、显著水平 B 、极显著水平 7、 生物统计中t 检验常用来检验 __________ A 、两均数差异比较 B 、两个数差异比较 C 无显著差异 D 、没法判断 C 两总体差异比较 D 、多组数据差异比 较 D 、有效假设

生物统计学考试题及答案

生物统计学考试题及答案

重庆西南大学 2012 至 2013 学年度第 2 期 生物统计学 试题(A ) 试题使用对象: 2011 级 专 业(本科) 命题人: 考试用时 120 分钟 答题方式采用: 一:判断题;(每小题1分,共10分 ) 1、正确无效假设的错误为统计假设测验的第一类错误。( ) 2、标准差为5,B 群体的标准差为12,B 群体的变异一定大于A 群体。( ) 3、一差异”是指仅允许处理不同,其它非处理因素都应保持不变。( ) 4、30位学生中有男生16位、女生14位,可推断该班男女生比例符合1∶1(已 知84.321,05.0=χ)。 ( ) 5、固定模型中所得的结论仅在于推断关于特定的处理,而随机模型中试验结论则将用于推断处理的总体。( ) 6、率百分数资料进行方差分析前,应该对资料数据作反正弦转换。( ) 7、比较前,应该先作F 测验。 ( ) 8、验中,测验统计假设H 00:μμ≥ ,对H A :μμ<0 时,显著水平为5%,则测验的αu 值为1.96( ) 9、行回归系数假设测验后,若接受H o :β=0,则表明X 、Y 两变数无相关关系。( ) 10、株高的平均数和标准差为30150±=±s y (厘米),果穗长的平均数和标准差为s y ±1030±=(厘米),可认为该玉米的株高性状比果穗性状变异大。 ( ) 二:选择题;(每小题2分,共10分 ) 1分别从总体方差为4和12的总体中抽取容量为4的样本,样本平均数分别为3和2,在95%置信度下总体平均数差数的置信区间为( )。

A 、[-9.32,11.32] B 、[-4.16,6.16] C 、[-1.58,3.58] D 、都不是 2、态分布不具有下列哪种特征( )。 A 、左右对称 B 、单峰分布 C 、中间高、两头低 D 、概率处处相等 3、一个单因素6个水平、3次重复的完全随机设计进行方差分析,若按最小显著差数法进行多重比较,比较所用的标准误及计算最小显著差数时查表的自由度分别为( )。 A 、 2MSe/6 , 3 B 、 MSe/6 , 3 C 、 2MSe/3 , 12 D 、 MSe/3 , 12 4、已知),N(~x 2σμ,则x 在区间]96.1,[σμ+-∞的概率为( )。 A 、0.025 B 、0.975 C 、0.95 D 、0.05 5、 方差分析时,进行数据转换的目的是( )。 A. 误差方差同质 B. 处理效应与环境效应线性可加 C. 误差方差具有正态性 D. A 、B 、C 都对 三、简答题;(每小题6分,共30分 ) 1、方差分析有哪些步骤? 2、统计假设是?统计假设分类及含义? 3、卡方检验主要用于哪些方面? 4、显著性检验的基本步骤? 5、平均数有哪些?各用于什么情况? 四、计算题;(共4题、50分) 1、进行大豆等位酶Aph 的电泳分析,193份野生大豆、223份栽培大豆等位基因型的次数列于下表。试分析大豆Aph 等位酶的等位基因型频率是否因物种而不同。( 99 .52 05.0,2=χ, 81 .7205.0,3=χ)(10分) 野生大豆和栽培大豆Aph 等位酶的等位基因型次数分布 物 种 等位基因型 1 2 3 野生大豆 29 68 96

李春喜《生物统计学》第三版 课后作业答案知识分享

李春喜《生物统计学》第三版课后作 业答案

《生物统计学》第三版课后作业答案 (李春喜、姜丽娜、邵云、王文林编著) 第一章概论(P7) 习题1.1 什么是生物统计学?生物统计学的主要内容和作用是什么? 答:(1)生物统计学(biostatistics)是用数理统计的原理和方法来分析和解释生物界各种现象和实验调查资料,是研究生命过程中以样本来推断总体的一门学科。 (2)生物统计学主要包括实验设计和统计推断两大部分的内容。其基本作用 表现在以下四个方面:①提供整理和描述数据资料的科学方法;②确定某些性状和特性的数量特征;③判断实验结果的可靠性;④提供由样本推断总体的方法;⑤提供实验设计的一些重要原则。 习题1.2 解释以下概念:总体、个体、样本、样本容量、变量、参数、统计数、效应、互作、随机误差、系统误差、准确性、精确性。 答:(1)总体(populatian)是具有相同性质的个体所组成的集合,是研究对象的全体。 (2)个体(individual)是组成总体的基本单元。 (3)样本(sample)是从总体中抽出的若干个个体所构成的集合。 (4)样本容量(sample size)是指样本个体的数目。 (5)变量(variable)是相同性质的事物间表现差异性的某种特征。 (6)参数(parameter)是描述总体特征的数量。

(7)统计数(statistic)是由样本计算所得的数值,是描述样本特征的数量。 (8)效应(effection)试验因素相对独立的作用称为该因素的主效应,简称效应。 (9)互作(interaction)是指两个或两个以上处理因素间的相互作用产生的效应。 (10)实验误差(experimental error)是指实验中不可控因素所引起的观测值偏 离真值的差异,可以分为随机误差和系统误差。 (11)随机误差(random)也称抽样误差或偶然误差,它是有实验中许多无法控 制的偶然因素所造成的实验结果与真实结果之间产生的差异,是不可避 免的。随机误差可以通过增加抽样或试验次数降低随机误差,但不能完 全消。 (12) 系统误差(systematic)也称为片面误差,是由于实验处理以外的其他 条件明显不一致所产生的倾向性的或定向性的偏差。系统误差主要由一 些相对固定的因素引起,在某种程度上是可控制的,只要试验工作做得 精细,在试验过程中是可以避免的。 (13) 准确性(accuracy)也称为准确度,指在调查或实验中某一实验指标或 性状的观测值与其真值接近的程度。 (14) 精确性(precision)也称精确度,指调查或实验中同一实验指标或性状 的重复观测值彼此接近程度的大小。 (15)准确性是说明测定值堆真值符合程度的大小,用统计数接近参数真值 的程度来衡量。精确性是反映多次测定值的变异程度,用样本间的各 个变量间变异程度的大小来衡量。

生物统计学

生物统计学-数理统计对生命的诠释 生物统计(biostatistics)即用数理统计的原理和方法,分析和解释生物界的种种现象和数据资料,以求把握其本质和规律性。这个专业非常Interdisciplinary ,跟统计、生物信息、计算机(尤其是data mining)等关系很密切。 生统学什么?在美国的专业设置以及课程设置是怎样的? 先从生物统计项目的开设情况说起,在美国Top30的学校中,有19所学校开设了生统的Master项目,Top70的院校中超过一半的学校均开设有Biostatistics项目。 按学院名称分类: School of Public Health - e.g. JHU, Harvard, Yale, Columbia, Emory, U Mich, Brown etc. School/ College of Medicine, Medical Center

-e.g. Duke, U Penn, WUSTL, USC, Case etc. School of Arts and Science -e.g. UCD, Connecticut etc. 这其中,大部分学校是开设在公共卫生学院下的(School of Public Health) 按项目名称分类: -MS/MA in Biostatistics -MPH/MSPH in Biostatistics MPH in Biostatistics核心课程,以Emory为例: Statistical Methods-统计方法 Statistics for Experimental Biology-统计实验生物学 Biostatistical Methods-生物统计方法 Statistical Inference-统计推断 Probability Theory-概率论 Modern Regression Analysis-现代回归分析 SAS Programming-SAS编程 Statistical Computing-统计计算 Stochastic Processes-随机过程 一般来说要求的先修课程: Multivariable Calculus-多元微积分

生物统计学期末复习题

统计选择题 1,由于(1,研究对象本身的性质)造成我们所遇到的各种统计数据的不齐性。 2,研究某一品种小麦株高,因为该品种小麦是个极大的群体,其数量甚至于是个天文数字,该体属于(4,无限总体) 3,从总体中(2,随机抽出)一部分个体称为样本。 4,用随机抽样方法从总体中获得一个样本的过程称为(3,抽样) 5,身高,体重,年龄这一类数据属于(3,连续型数据;1,度量数据) 6,每10个中男性人数,每亩麦田中杂草株数,喷洒农药后每100只害虫中死虫数等,这一类数据属于(1,离散型数据;2,计数数据) 7,把频数按其组值的顺序排列起来,称为(3,频数分布) 8,以组值作为一个边,相应的频数为另一个边,做成的连续矩形图称为(2,直方图)9,绘制(4,多边形图)的方法是在坐标平面内点上各点(中值,频数),以线段连接各点,最高和最低非零频数点与相邻零频数点相连。 10,累积频数图是根据(3,累积频数表)直接绘出的。 11,样本数据总和除以样本含量,称为(算数平均数 12,已知样本平方和为360,样本含量为10,以下4种结果中(2,6.0)是正确的标准差。 13,概率的古典定义是(2,基本事件数与事件总数之比) 14,下面第(2,概率是事物所固有的特性) 15,对于事件A和B,P(A∪B)等于(2,P(AB)) 16,对于事件A和事件B,P(A|B)等于(P(AB)/P(B)) 17,对于任意事件A和B,P(AB)等于(P(B)P(B|A)) 18,下述(3随机试验中所输入的变量)项称为随机变量 19,关于连续型随机变量,有以下4种提法,其中(1,可取某一区间内的任何数值)20,总体平均数可以用以下4种符号中的一种表示,它是(2,μ) 21,样本标准差可以用以下4种符号中的一种表示,它是(1,s) 22,在养鱼场中,A鱼塘的面积占10%,A鱼塘中鱼的发病率为1%,问从养鱼场中任意捕捞一条鱼,它既是A鱼塘,又是生病的鱼的概率是(4,0.003) 23,以下4点是描述连续型随机变量特征的,其中(2,f(x)=lim △x→0P(x

生物统计学(版)杜荣骞课后习题答案统计数据的收集与

第一章统计数据的收集与整理1.1 算术平均数是怎样计算的?为什么要计算平均数? 答:算数平均数由下式计算:n y y n i i ∑ = =1 ,含义为将全部观测值相加再被观测值的个数 除,所得之商称为算术平均数。计算算数平均数的目的,是用平均数表示样本数据的集中点,或是说是样本数据的代表。 1.2 既然方差和标准差都是衡量数据变异程度的,有了方差为什么还要计算标准差? 答:标准差的单位与数据的原始单位一致,能更直观地反映数据地离散程度。 1.3 标准差是描述数据变异程度的量,变异系数也是描述数据变异程度的量,两者之间有什么不同? 答:变异系数可以说是用平均数标准化了的标准差。在比较两个平均数不同的样本时所得结果更可靠。 1.4 完整地描述一组数据需要哪几个特征数? 答:平均数、标准差、偏斜度和峭度。 1.5 下表是我国青年男子体重(kg)。由于测量精度的要求,从表面上看像是离散型数据,不要忘记,体重是通过度量得到的,属于连续型数据。根据表中所给出的数据编制频数分布表。 66 69 64 65 64 66 68 65 62 64 69 61 61 68 66 57 66 69 66 65 70 64 58 67 66 66 67 66 66 62 66 66 64 62 62 65 64 65 66 72 60 66 65 61 61 66 67 62 65 65 61 64 62 64 65 62 65 68 68 65 67 68 62 63 70 65 64 65 62 66 62 63 68 65 68 57 67 66 68 63 64 66 68 64 63 60 64 69 65 66 67 67 67 65 67 67 66 68 64 67 59 66 65 63 56 66 63 63 66 67 63 70 67 70 62 64 72 69 67 67 66 68 64 65 71 61 63 61 64 64 67 69 70 66 64 65 64 63 70 64 62 69 70 68 65 63 65 66 64 68 69 65 63 67 63 70 65 68 67 69 66 65 67 66 74 64 69 65 64 65 65 68 67 65 65 66 67 72 65 67 62 67 71 69 65 65 75 62 69 68 68 65 63 66 66 65 62 61 68 65 64 67 66 64 60 61 68 67 63 59 65 60 64 63 69 62 71 69 60 63 59 67 61 68 69 66 64 69 65 68 67 64 64 66 69 73 68 60 60 63 38 62 67 65 65 69 65 67 65 72 66 67 64 61 64 66 63 63 66 66 66 63 65 63 67 68 66 62 63 61 66 61 63 68 65 66 69 64 66 70 69 70 63 64 65 64 67 67 65 66 62 61 65 65 60 63 65 62 66 64 答:首先建立一个外部数据文件,名称和路径为:E:\data\exer1-5e.dat。所用的SAS程序和计算结果如下: proc format; value hfmt 56-57='56-57' 58-59='58-59' 60-61='60-61' 62-63='62-63' 64-65='64-65' 66-67='66-67'

生物统计学考试试卷及答案

考试轮次:2017-2018学年第一学期期末考试试卷编号 考试课程:[120770] 生物统计与实验设计命题负责人曾汉元 适用对象:生物与食品工程学院生物科学专业2015级审查人签字 考核方式:上机考试试卷类型:A卷时量:150分钟总分:100分 注意:答案中要求保留必要的计算和推理过程,全部答案保存为一个Word文档,文件名 为学号最后两位数+姓名。考试结束后不要关机。提交答卷后,请到主机看一下是否提交成功。第1题12分,第3题5分,第10题13分,其余的题各10分。 1、下表为某大学96位男生的体重测定结果(单位:kg),请根据资料分别计算以下指标:(1)算术平均数;(2)几何平均数;(3)中位数;(4)众数;(5)极差;(6)方差;(7)标准差;(8)变异系数;(9)标准误。(10) 绘制各体重分布柱形图。 66 69 64 65 64 66 70 64 59 67 66 66 60 66 65 61 61 66 67 68 62 63 70 65 64 66 68 64 63 60 60 66 65 61 61 66 59 66 65 63 58 66 66 68 64 65 71 61 62 69 70 68 65 63 66 65 67 66 74 64 70 64 59 67 66 66 60 66 65 61 61 66 67 68 62 63 70 65 64 66 68 64 63 60 60 66 65 61 61 66 59 66 65 63 58 66 2、已知1000株水稻的株高服从正态分布N(97,3 2),求: (1)株高在94cm以上的概率? (2)株高在90~99cm之间的概率? (3)株高在多少cm之间的中间概率占全体的99%? 3.已知某批30个小麦样品的平均蛋白质含量为14.5%,σ=2.50%,试进行95%置信度下的蛋白质含量的区间估计和点估计。 4、有一大麦杂交组合,F2代的芒性状表型有钩芒、长芒和短芒三种,观察计得其株数依次分别为348、11 5、157,试检验其比率是否符合9:3:4的理论比率。 5、某医院用某种中药治疗7例再生障碍性贫血患者,现将血红蛋白含量(g/L)变化的数据列在下面,假定资料满足各种假设测验所要求的前提条件,问:治疗前后之间的差别有无显著性意义? 患者编号 1 2 3 4 5 6 7 治疗前血红蛋白含量65 75 50 76 65 72 68 治疗后血红蛋白含量82 112 125 85 80 105 128

耶鲁大学生物统计学专业介绍

耶鲁大学生物统计学专业介绍 耶鲁大学生物统计学专业由公共卫生学院提供。耶鲁大学目前在QS世界排名第15位,在美国排名第8位。该校统计学目前在美国 排名第31位,一起来了解。 1.专业概况 耶鲁大学生物统计学硕士生学习生物医学科学领域的统计方法理论和应用。毕业生中一直有人从事保健科学行业,在生物技术企业、政府部门、制药公司就业。 申请这个生物统计学专业需要有数学、统计学和一门定量学科学习经历。数学的最低要求是学过一年微积分和一门线性代数。 除了生物统计学理学硕士,耶鲁大学也在这个领域开设公共卫生硕士专业。如果你想进一步了解这个公共卫生硕士专业,了解理学 硕士与公共卫生硕士的不同,请参加公共卫生硕士生物统计学网页。 请注意,理学硕士和公共卫生硕士可以同时申请。 2.学位要求 生物统计学理学硕士要求至少完成15个学分,学生必须完成以 下课程。 生物统计学与文献报告会(JournalClub)研讨、临床试验基础(一个学分)、应用回归分析(一个学分)、分类数据分析(一个学分)、纵 向与多层面数据分析(一个学分)、应用生存分析(一个学分)、统计 实践(第一部分、一个学分)、高级统计编程(一个学分)、统计实践(第二部分、一个学分)、概率理论(一个学分)、统计学理论(一个学分)、流行病学与公共卫生基础(一个学分)、生物统计学研究夏季实习。研究伦理学与责任。

从以下课程选择二门选修: 计算统计学(一个学分)、贝叶斯统计(一个学分)、生存分析理论(一个学分)、非参数统计方法及其应用(一个学分)、公共卫生空间统计学(一个学分)、广义线性模型理论(一个学分)。 此外,生物统计学专业的所有硕士生还需要完成一个专业发展系列。 有意向完成一篇论文的学生可以选择这样做。选择完成论文的学生必须在公开研讨会上展示研究成果,才能毕业。已经拿到公共卫生硕士或相关研究生学位的学生可以免除这个要求。 3.硕士论文 第二年的时候,生物统计学理学硕士方向的学生可以选择在老师指导下完成一个独立研究。这个研究项目一般要落在以下三个主要领域,它们分别是统计学新理论/方法论发展、现有方法特征的计算机辅助模拟、实时数据集分析。 如果选择提交一篇论文,学生将必须提交一篇书面和完成答辩才能毕业。所提交的论文必须是在生物统计学教职人员监督下完成。

生物统计学期末复习题库及答案

第一章 填空 1.变量按其性质可以分为(连续)变量和(非连续)变量。 2.样本统计数是总体(参数)的估计值。 3.生物统计学是研究生命过程中以样本来推断(总体)的一门学科。 4.生物统计学的基本内容包括(试验设计)和(统计分析)两大部分。 5.生物统计学的发展过程经历了(古典记录统计学)、(近代描述统计学)和(现代推断统计学)3个阶段。 6.生物学研究中,一般将样本容量(n ≥30)称为大样本。 7.试验误差可以分为(随机误差)和(系统误差)两类。 判断 1.对于有限总体不必用统计推断方法。(×) 2.资料的精确性高,其准确性也一定高。(×) 3.在试验设计中,随机误差只能减小,而不能完全消除。(∨) 4.统计学上的试验误差,通常指随机误差。(∨) 第二章 填空 1.资料按生物的性状特征可分为(数量性状资料)变量和(质量性状资料)变量。 2. 直方图适合于表示(连续变量)资料的次数分布。 3.变量的分布具有两个明显基本特征,即(集中性)和(离散性)。 4.反映变量集中性的特征数是(平均数),反映变量离散性的特征数是(变异数)。 5.样本标准差的计算公式s=( )。 判断题 1. 计数资料也称连续性变量资料,计量资料也称非连续性变量资料。(×) 2. 条形图和多边形图均适合于表示计数资料的次数分布。(×) 3. 离均差平方和为最小。(∨) 4. 资料中出现最多的那个观测值或最多一组的中点值,称为众数。(∨) 5. 变异系数是样本变量的绝对变异量。(×) 单项选择 1. 下列变量中属于非连续性变量的是( C ). A. 身高 B.体重 C.血型 D.血压 2. 对某鱼塘不同年龄鱼的尾数进行统计分析,可做成( A )图来表示. A. 条形 B.直方 C.多边形 D.折线 3. 关于平均数,下列说法正确的是( B ). A. 正态分布的算术平均数和几何平均数相等. B. 正态分布的算术平均数和中位数相等. C. 正态分布的中位数和几何平均数相等. D. 正态分布的算术平均数、中位数、几何平均数均相等。 4. 如果对各观测值加上一个常数a ,其标准差( D )。 A. 扩大√a 倍 B.扩大a 倍 C.扩大a 2倍 D.不变 5. 比较大学生和幼儿园孩子身高的变异度,应采用的指标是( C )。 A. 标准差 B.方差 C.变异系数 D.平均数 第三章 12 2--∑∑n n x x )(

生物统计学课后习题解答-李春喜汇总

生物统计学课后习题解答-李春喜汇总

第一章概论 解释以下概念:总体、个体、样本、样本容量、变量、参数、统计数、效应、互作、随机误差、系统误差、准确性、精确性。 第二章试验资料的整理与特征数的计算习题 2.1 某地 100 例 30 ~ 40 岁健康男子血清总胆固醇(mol · L -1 ) 测定结果如下: 4.77 3.37 6.14 3.95 3.56 4.23 4.31 4.71 5.69 4.12 4.56 4.37 5.39 6.30 5.21 7.22 5.54 3.93 5.21 6.51 5.18 5.77 4.79 5.12 5.20 5.10 4.70 4.74 3.50 4.69 4.38 4.89 6.25 5.32 4.50 4.63 3.61 4.44 4.43 4.25 4.03 5.85 4.09 3.35 4.08 4.79 5.30 4.97 3.18 3.97 5.16 5.10 5.85 4.79 5.34 4.24 4.32 4.77 6.36 6.38 4.88 5.55 3.04 4.55 3.35 4.87 4.17 5.85 5.16 5.09 4.52 4.38 4.31 4.58 5.72 6.55 4.76 4.61 4.17 4.03 4.47 3.40 3.91 2.70 4.60 4.09 5.96 5.48 4.40 4.55 5.38 3.89 4.60 4.47 3.64 4.34 5.18 6.14 3.24 4.90 计算平均数、标准差和变异系数。 【答案】=4.7398, s=0.866, CV =18.27 % 2.2 试计算下列两个玉米品种 10 个果穗长度 (cm) 的标准差和变异系数,并解释所得结果。 24 号: 19 , 21 , 20 , 20 , 18 , 19 , 22 , 21 , 21 , 19 ; 金皇后: 16 , 21 , 24 , 15 , 26 , 18 , 20 , 19 , 22 , 19 。 【答案】 1 =20, s 1 =1.247, CV 1 =6.235% ; 2 =20, s 2 =3.400, CV 2 =17.0% 。 2.3 某海水养殖场进行贻贝单养和贻贝与海带混养的对比试验,收获时各随机抽取 50 绳测其毛重(kg) ,结果分别如下:

生物统计学习题

第一章绪论 一、名词解释 总体个体样本样本含量随机样本参数统计量准确性精确性 第二章资料的整理 一、名词解释 数量性状资料质量性状资料半定量(等级)资料计数资料计量资料 第三章平均数、标准差与变异系数 一、名词解释 算术平均数几何平均数中位数众数调和平均数标准差方差离均差的平方和(平方和)变异系数 二、简答题 1、生物统计中常用的平均数有几种?各在什么情况下应用? 2、算术平均数有哪些基本性质? 3、标准差有哪些特性? 三、应用题 计算下面两个玉米品种的10个果穗长度(cm)的平均数、标准差和变异系数,解释所得结果。 BS24:19 21 20 20 18 19 22 21 21 19 金皇后:16 21 24 15 26 18 20 19 22 19 四、计算题 1、10头母猪第一胎的产仔数分别为:9、8、7、10、1 2、10、11、14、8、9头。试计算这10头母猪第一胎产仔数的平均数、标准差和变异系数。 2、随机测量了某品种120头6月龄母猪的体长,经整理得到如下次数分布表。试利用加权法计算其平均数、标准差与变异系数。 组别组中值(x)次数(f) 80—84 2 88—92 10

96— 100 29 104— 108 28 112— 116 20 120— 124 15 128— 132 13 136— 140 3 3、某年某猪场发生猪瘟病,测得10头猪的潜伏期分别为2、2、3、3、 4、4、4、 5、9、12(天)。试求潜伏期的中位数。 4、某良种羊群1995—2000年六个年度分别为240、320、360、400、420、450只,试求该良种羊群的年平均增长率。 5、某保种牛场,由于各方面原因使得保种牛群世代规模发生波动,连续5个世代的规模分别为:120、130、140、120、110头。试计算平均世代规模。 6、调查甲、乙两地某品种成年母水牛的体高(cm )如下表,试比较两地成年母水牛体高的变异程度。 甲地 137 133 130 128 127 119 136 132 乙地 128 130 129 130 131 132 129 130 第四章 常用概率分布 一、名词解释 随机事件 概率的统计定义 小概率原理 正态分布 标准正态分布 双侧概率(两尾概率) 单侧概率(一尾概率) 二项分布 波松分布 标准误 二、简答题 1、事件的概率具有那些基本性质? 2、正态分布的密度曲线有何特点? 3、标准误与标准差有何联系与区别? 4、样本平均数抽样总体与原始总体的两个参数间有何联系? 三、计算题 1、 已知随机变量u 服从 N(0,1),求P(u <-1.4), P(u ≥1.49), P (|u |≥2.58), P(-1.21≤u <0.45),并作图示意。 2、已知随机变量u 服从N(0,1),求下列各式的αu 。 (1) P(u <-αu )+P(u ≥αu )=0.1;0.52 (2) P(-αu ≤u <αu )=0.42;0.95 3、猪血红蛋白含量x 服从正态分布N(12.86,1.332)

生物统计学试题及答案

生物统计学考试 一.判断题(每题2分,共10分) √1. 分组时,组距和组数成反比。 ×2. 粮食总产量属于离散型数据。 ×3. 样本标准差的数学期望是总体标准差。 ×4. F分布的概率密度曲线是对称曲线。 √5. 在配对数据资料用t检验比较时,若对数n=13,则查t表的自由度为12。 二. 选择题(每题3分,共15分) 6.x~N(1,9),x1,x2,…,x9是X的样本,则有() A.31 - x ~N(0,1) B.11 - x ~N(0,1) C.91 - x ~N(0,1) D.以上答案均不正确 7. 假定我国和美国的居民年龄的方差相同。现在各自用重复抽样方法抽取本国人口的1%计 算平均年龄,则平均年龄的标准误() A.两者相等 B.前者比后者大 C.前者比后者小 D.不能确定大小 8. 设容量为16人的简单随机样本,平均完成工作需时13分钟。已知总体标准差为3分钟。 若想对完成工作所需时间总体构造一个90%置信区间,则() A.应用标准正态概率表查出u值 B.应用t分布表查出t值 C.应用卡方分布表查出卡方值 D.应用F分布表查出F值 9. 1-α是() A.置信限 B.置信区间 C.置信距 D.置信水平 10. 如检验k (k=3)个样本方差s i2 (i=1,2,3)是否来源于方差相等的总体,这种检验在统计 上称为( )。 A.方差的齐性检验 B. t检验 C. F检验 D. u检验 三. 填空题(每题3分,共15分) 11. 在一个有限总体中要随机抽样应采用放回式抽样方法。 12. 在实际抽样工作中,为了减小标准误,最常用的办法就是增大样品容量。 13. 已知F分布的上侧临界值F0.05(1,60)=4.00,则左尾概率为0.05,自由度为(60,1) 的F分布的临界值为 0.25 14. 衡量优良估计量的标准有无偏性、有效性和相容性。 15. 已知随机变量x服从 N (8,4),P(x < 4.71)= 0.05 。(填数字) 四.综合分析题(共60分) 16.何谓“小概率原理”?算术平均数有两条重要的性质,是什么? 小概率的事件,在一次试验中,几乎是不会发生的。若根据一定的假设条件,计算出来该事件发生的概率很小,而在一次试验中,它竟然发生了,则可以认为假设的条件不正确,从而否定假设。 算术平均数的性质: 1.离均差之和为零 2. 离均差平方之和最小 17.计算5只山羊产绒量:450, 450,500, 550, 550(g)的标准差。 标准差 18.一农场主租用一块河滩地,若无洪水则年终可获利20000元,若发洪水则会损失12000

《生物统计学》试题A

《生物统计学》基本知识题 一、填空题 第一章 1.填写下列符号的统计意义:①SS ②S x ③ S2 ④ SP xy。 2.t检验、u检验主要用于____ 组数据的差异显著性检验; F 检验主要用于____ _ 组数据的差异显著性检验。 3.试验误差指由因素引起的误差,它不可,但可 以和。 4.参数是由____计算得到的,统计量是由____计算得到的。 5.由样本数据计算得到的特征数叫,由总体数据计算 得到的特征数叫。 9.一般将原因产生的误差叫试验误差,它避免, 但可以和。 第二章 4.变异系数可用于当两个样本的、不同时 变异程度的比较。变异系数的计算公式为。 5.变异系数可用于当两个样本的、不同时 的比较。变异系数的计算公式为。 7.连续性随机变量等组距式次数分布表的编制方法步骤为: ①_____、②____、③____、④____、⑤___。 8.计算标准差的公式是S=。 9.变异系数的计算公式是CV=。 10. 标准差的作用是①、②、③。 12.算术平均数的两个重要性质是①②。 13.样本平均数的标准差叫。它与总体标准差的关系 是。 第三章 1.若随机变量x~N(μ,σ2),欲将其转换为u~N(0,1),则 标准化公式为u=。 第四 1.统计量与参数间的误差叫,其大小受①② ③的影响,其大小可以用来描述,计算公式 为。 2.抽样误差是指之差。抽样误差的大小可用来表 示。影响抽样误差的因素有、和。 6.在两个均数的显著性检验中,若检验结果是差异显著,则说 明。 7.在显著性检验时,当H0是正确的,检验结果却否定了H0,这 时犯的错误是:型错误。 8. 显著性检验时,犯Ⅰ型错误的概率等于。 9.显著性检验分为_______ 检验和______检验。 10.显著性检验的方法步骤为:、、。 12.若服从N(, 2)分布,则值服从分布, 值服从分布。 第五章 1.方差分析是以为检验对象的。在实际分析时常常以 作为它的估计值。 2.多重比较的方法有①和②两类;①一般适用于 组均数的检验,②适用于组均数间的检验。 3.多重比较的LSD法适用于组均数比较;LSR法适用于 组均数间的比较。 4.多重比较的方法有和两类。前者一般用于 组均数检验,后者又包含和法,适用于组 均数的比较。第六章 1.χ2 检验中,连续性矫正是指用性分布检验性数据所产生的差异,当或时,必须进行矫正。 2.在χ2检验时,当和时必须进行连续性矫正。3.χ2检验中,当或时,必须进行连续性矫正,矫正方法有_____ 和_____ 两种。 4.χ2检验的计算公式为χ2=,当、时,必须矫正,其矫正方法为、。 第七章 1.在直线相关回归分析中,相关系数显著,说明两变量间直线相关关系。 2.相关系数的大小,说明相关的紧密程度,其说明相关的性质。 相关系数r是用来描述两变量之间相关的和的指标,r 的正负号表示相关的,r的绝对值大小说明相关的。 3.变量间存在的关系,统计上称为相关关系。 4.回归分析中表示,byx表示,。 5.在回归方程中,表示依变量的,b表示,a表示。 6.已知r=-0.589*,则变量间存在的直线相关关系。 7.统计分析中,用统计量来描述两个变量间的直线相关关系,其取值范围为,其绝对值的大小说明相关的,其正负符号说明相关的。 第九章 1.试验设计的基本原则是、和。 二、单选题 1.比较胸围与体重资料的变异程度,以最好。 a.标准差b.均方c.全距d.变异系数 2.比较身高与体重两变量间的变异程度,用统计量较合适。 ①CV ②S ③R ④S2 4.若原始数据同加(或同减)一个常数,则。 a不变,S改变b.S不变,改变 c.两者均改变d.两者均不改变 5.比较身高和体重资料的变异程度,以指标最好。 a.CV b.Sc.Rd.S2 6.离均差平方和的代表符号是。 a.∑(x- )2 b.SP c.SS 7 .样本离均差平方和的代表符号是。 ①S2 ②③ ④SS 8. 愈小,表示用该样本平均数估计总体均数的可靠性愈大。 ①变异系数②标准差 ③全距④标准误 1.二项分布、Poisson分布、正态分布各有几个参数:() A、 (1,1,1 ) B、 (2,2,2) C、 (2,1, 2) D、 (2,2,1 ) 2.第一类错误是下列哪一种概率:()

统计学考研前100院校

统计学考研前100院校 统计学 专业代码:020208 学科大类:经济学 一级学科:应用经济学 统计学专业院校排名 第一档:天津财经大学、西南财经大学 第二档:上海财经大学、厦门大学、中国人民大学、中南财经政法大学、浙江工商大学、暨南大学、西安交通 学、中央财经大学 第三档:湖南大学、安徽财经大学、江西财经大学、北京大学、山西财经大学、东北财经大学、西安财经学院 学、河北经贸大学、天津大学、兰州商学院、云南财经大学、首都经济贸易大学、福建农林大学、重庆工商大学、 第四档:西北工业大学、江苏大学、河北大学、西北师范大学、贵州财经学院、长沙理工大学、广东商学院、 州电子科技大学、新疆财经学院、内蒙古财经学院、长春税务学院、河南财经学院、福州大学、山东财政学院、中 学。 统计学国家级重点学科单位 统计学一级国家重点学科:天津财经大学、西南财经大学 统计学二级国家重点学科:清华大学、吉林大学、华侨大学、国防大

学、军事经济学院 需要说明的是,这份统计学考研院校排名是根据教育部学位中心2013年11月授权发布《2012年学科评估结果》 猜想,之所有第一梯队是这两位,跟建校建系的时间有关。如西南财经大学统计学院的前身统计系,是1952年和1 系调整成立四川财经学院时首批组建的五个系之一,也是全国财经院校中最早招收统计学专业本科生的院系之一。 这里还有一份统计学专业的高校排名,可能这个比上面的容易被接受,也不是我编的,也是教育部考试中心发 学校代码及名称学科整体水平得分 10002 中国人民大学90 10001 北京大学88 10384 厦门大学85 10055 南开大学83 10200东北师范大学 10269 华东师范大学 10272 上海财经大学 10353 浙江工商大学 10358 中国科学技术大学78 10422 山东大学 下面还有一份财经类统计学专业名校盘点—— 1. 中央财经大学(国家重点学科合计11个)一个国家重点学科:

相关文档
最新文档