统计211

 找回密码
 立即注册

QQ登录

只需一步,快速开始

查看: 3799|回复: 0
打印 上一主题 下一主题

哑变量在SPSS和SAS进行回归分析应用

[复制链接]
跳转到指定楼层
1
发表于 2011-7-9 18:11:00 | 只看该作者 回帖奖励 |倒序浏览 |阅读模式
虚拟变量(Dummy Variable),又称虚设变量、名义变量或哑变量,是量化了的质变量,通常取值为0或1。引入哑变量可使线形回归模型变得更复杂,但对问题描述更简明。
       名义变量引入回归分析,必须进行数量化。如,职业有工人、农民、教师,分别赋值0,1,2。但是0,1,2代表的实际意义又不是由小到大的关系。所以这在回归分析中直接使用是错误的。如考虑季节因素时,用1,2,3,4编码也是不合理的,通常也进行哑变量化。
        对于有序变量,如轻、中、重,则要酌情考虑。如果样本量足够打的话,也进行哑变量化,这样可以得到不同级别的差异。但是如果样本量不够大是,哑变量化造成变量数目上升,使回归结果变得不可靠,只能适得其反。

哑变量设置的原则
       在模型中引入多个哑变量时,哑变量的个数应按下列原则确定:
       如果有m种互斥的属性类型,在模型中引入(m-1)个哑变量。
       例如,文化程度分小学、初中、高中、大学、研究生5类,引用4个哑变量

回归分析
        在spss中,logistics回归中,有专门的选项来处理需要哑变量化的变量,只需单击“Categorical..”进行设置即可。但是对于多元线性回归就没有那么幸运了。
       用computer或recode设置一组哑变量。由于哑变量是一个整体变量,所以进行变量筛选时必须共同进退。因此,讲所有哑变量同一般变量一下直接进行筛选是不对的,会出现一部分变量进入一部分变量未进入的情形。解决的方法是:将同一因素下的哑变量进行归组,在纳入方法中选择了“ENTER”来确保这些哑变量同进同出,而其它连续型变量和二分类变量则归为另一组,纳入方法为STEPWISE。然后在没有纳入这组哑变量的情况下再做一次STEPWISE,再来比较是不是应该纳入这组哑变量。

在sas中,哑变量的设置需要另外写程序,但是在回归程序中,则比较简单。eg.因变量y,自变量x1,x2,哑变量组x31 x32 x33,
proc reg;
  model y=x1 x2 {x31 x32 x33} /selection=stepwise;
run;
即,把哑变量组用{}括起来就可以了。
分享到:  QQ好友和群QQ好友和群 QQ空间QQ空间 腾讯微博腾讯微博 腾讯朋友腾讯朋友
收藏收藏 转播转播 分享分享 分享淘帖 支持支持 反对反对
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则


免责声明|关于我们|小黑屋|联系我们|赞助我们|统计211 ( 闽ICP备09019626号  

GMT+8, 2025-4-17 14:05 , Processed in 0.077940 second(s), 23 queries .

Powered by Discuz! X3.2

© 2001-2013 Comsenz Inc.

快速回复 返回顶部 返回列表