r语言logistics回归的y怎么做连续值

如题所述

第1个回答  2022-09-30
1、概念不同:

(1)多重线性回归模型可视为简单直线模型的直接推广,具有两个及两个以上自变量的线性模型即为多重线性回归模型。

(2)logistic属于概率型非线性回归,是研究二分类(可扩展到多分类)观察结果与一些影响因素之间关系的一种多变量分析方法。

2、变量的特点

多元回归分析的应变量:1个;数值变量(正态分布);自变量:2个及2个以上;最好是数值变量,也可以是无序分类变量、有序变量。

logistic回归的分析应变量:1个;二分 类变量(二项分布)、无序 /有序多分类变量;自变量:2个及2个以上;数值变量、二分类变量、无序/有序多分类变量。

总体回归模型LogitP=(样本)偏回归系数含义表示在控制其它因素或说扣除其它因素的作用后(其它所有自变量固定不变的情况下),某一个自变量变化一个单位时引起因变量Y变化的平均大小。

表示在控制其它因素或说扣除其它因素的作用后(其它所有自变量固定不变的情况下),某一因素改变一个单位时,效应指标发生与不发生事件的概率之比的对数变化值(logitP的平均变化量),即lnOR。

3、适用条件LINE:

1、L:线性——自变量X与应变量Y之间存在线性关系;

2、I:独立性——Y值相互独立,在模型中则要求残差相互独立,不存在自相关;

3、N:正态性——随机误差(即残差)e服从均值为零,方差为 2的正态分布;

4、E:等方差——对于所有的自变量X,残差e的方差齐。

观察对象(case)之间相互独立;若有数值变量,应接近正态分布(不能严重偏离正态分布);二分类变量服从二项分布;要有足够的样本量;LogitP与自变量呈线性关系。
相似回答