今天更新续文,上篇文章写了生存曲线的画法,但是留了一个问题没有解决,就是Kaplan-Meier生存曲线实际上仅仅把病人分为两组做了生存率随时间的比较,但是它并没有考虑协变量。R数据分析:生存分析的做法和结果解释
那么,我们做研究的时候,你发现了两个组的生存情况不一样,是不是下一步你就要想看看到底是那些因素影响了我们的生存情况。今天的文章就尝试着解决这么样问题。
问题描述
我们今天要关注的问题变了,我们会想要探讨很多因素造成的病人生存情况的差异:
比如,我们今天想来探究一下究竟是哪些因素会影响结肠癌患者的生存情况,我们的备选因素有3个,分别是性别sex,治疗方法rx和癌肿附着情况adhere(是否附着到其他器官,2分类变量)。
那么数据集依然是survival包自带的colon数据集。
对于我们的研究问题,我可以很自然地想要做亚组分析,穷尽所有亚组来看差异,首先我们依然用Kaplan-Meier方法拟合生存曲线:
require("survival")
fit2 <- survfit( Surv(tim