相当数量的问题,我今天做了。计算两个数据集的置信区间
我想计算置信区间(99%的水平,而不是95)为可变两岁dataframes,infert_control
和infert_patient
的平均值,其中:
infert_control = subset(infert$age, infert$case == 0)
infert_patient = subset(infert$age, infert$case == 1)
infert
是一个内置的R数据集,对于那些不熟悉它的人,这里是:病例0命名为对照组患者,病例1实际的。
> infert
education age parity induced case spontaneous stratum pooled.stratum
1 0-5yrs 26 6 1 1 2 1 3
2 0-5yrs 42 1 1 1 0 2 1
3 0-5yrs 39 6 2 1 0 3 4
4 0-5yrs 34 4 2 1 0 4 2
5 6-11yrs 35 3 1 1 1 5 32
6 6-11yrs 36 4 2 1 1 6 36
7 6-11yrs 23 1 0 1 0 7 6
8 6-11yrs 32 2 0 1 0 8 22
9 6-11yrs 21 1 0 1 1 9 5
10 6-11yrs 28 2 0 1 0 10 19
11 6-11yrs 29 2 1 1 0 11 20
...
239 12+ yrs 38 6 0 0 2 74 63
240 12+ yrs 26 2 1 0 1 75 49
241 12+ yrs 31 1 1 0 0 76 45
242 12+ yrs 31 2 0 0 1 77 53
243 12+ yrs 25 1 0 0 1 78 41
244 12+ yrs 31 1 0 0 1 79 45
245 12+ yrs 34 1 0 0 0 80 47
246 12+ yrs 35 2 2 0 0 81 54
247 12+ yrs 29 1 0 0 1 82 43
248 12+ yrs 23 1 0 0 1 83 40
什么是解决此问题的正确方法?
我已经计算age
列的两个infert_control
和infert_patient
,加上每个子集的标准偏差的平均值。
这是一个统计问题。但你可以报告正确的'分位数' – rawr
也许't.test'可以帮到你吗? – Fernando
@Fernando由于本练习的第二部分需要't.test()',所以我认为我不应该在这部分中使用它,这是第一部分。这整个事情是一个介绍到R的任务。 –