相关确定是要分析不同因素间的相关性?
相关性分析主要用于:(1)判断两个或多个变量之间的统计学关联;(2)如果存在关联,进一步分析关联强度和方向。
那么,什么样的研究可以进行相关性分析呢?我们在这里列举了几个相关性研究的例子供大家参考:
判断拟研究变量的数量确定要进行相关性分析后,对两个变量或多个变量进行相关性分析所采取的统计方法是不同的。那么,怎么判断研究变量的数量呢?
我们分别就两个变量的研究和三个及以上变量的研究进行了举例,帮助大家理解。同时,我们也对例子中变量数据类型进行了描述(如,连续变量、二分类变量、无序分类变量和有序分类变量)。
1 、两个变量 2 、三个及以上变量 判断拟研究变量的类型确定拟分析变量之间的相关性后,我们需要判断变量的数据类型。
变量的数据类型主要分为连续变量、二分类变量、无序分类变量和有序分类变量4类。拟分析的变量可以同属于一个数据类型,也可以分属不同的数据类型。根据这两个变量数据类型的不同,应采用的统计分析方法也不同。
1、连续变量连续变量是指对连续的指标测量所得到的数值,比如体重。其特点是等距区间的差异相同,例如体重在50kg-60kg之间的差异与60kg-70kg之间的差异相同。连续变量的示例如下:
-
距离(以米为单位)
-
温度(以摄氏度为单位)
-
时间(以小时为单位)
-
体重(以千克为单位)
-
成绩(以0-100分为计算区间)
有序分类变量可以有两个或者多个已排序的类别。举例来说,如果某患者的治疗结果是“痊愈”、“好转”、“不变”或者“恶化”。这就是一个有序分类变量,因为可以对四个类别进行排序。
需要注意的是,虽然我们可以对有序分类变量的类别排序,但还需要判断这种类别排序是不是等距的。例如,用各年龄段的近似中位数代表年龄类别,即24(18-30)岁、40(31-50)岁、60(51-70)岁、80(70岁以上)岁,可以将年龄视为定距变量。
但将患者的诊疗结果“痊愈”、“好转”、“无变化”或者“恶化”就不能认为是等距的,换句话说,不能认为“好转”是“无变化”的2倍;也不能认为“痊愈”和“好转”的差异与“不变”和“恶化很满意”的差异一样,即有序分类变量各类别之间不是可能是定距、也可能不是定距的,这是与连续变量的根本不同。有序分类变量的示例如下:
-
患者对医疗效果的满意程度,用5类测量:1-非常不满意、2-不满意、3-一般、4-满意、5-非常满意
-
对疾病的疗效:用4类测量:1-痊愈、2-好转、3-不变、4-变差
-
BMI指数是一种用于评估体重水平的指标。一般来说,BMI是连续变量(例如BMI为23.7或BMI为34.1),但按以下方式分类时可以视为有序分类变量:体重过轻(BMI小于18.5)、健康/正常体重(BMI在18.5—23.9之间)、超重(BMI在24—27.9之间)和肥胖(BMI大于28)。
二分类变量是只有两个类别的分类变量。二分类变量的类别之间没有顺序,不能像有序分类变量的类别那样进行排序。比如,性别变量就是一个二分类变量,可以分为“男性”和“女性”两个分类。再如,罹患心脏病也是一个二分类变量,分为“是”和“否”两个分类。
二分类变量类别是互斥的,一个研究对象不能同时分属于两个类别,比如一个人不能同时是男性或者女性,也不能同时患有心脏病又没有心脏病。二分类变量的示例如下:
本文地址:民生常识频道,楚汉网—湖北本地生活服务平台,捕捉湖北武汉生活大小事件动态,时时分享热点资讯,以及提供湖北各地吃喝玩乐,相亲交友,人才招聘,房产买卖,农产品批发,团购旅游门票,热点娱乐事件等一站式资讯。让您了解湖北的方方面面;另外,本站原创文章,转载本站资讯请保留本文地址,谢谢!