R语言用泊松Poisson回归、GAM样条曲线模型预测骑自行车者的数量

2024-08-01 05:57:07

原文链接：http://tecdat.cn/?p=18550

我根据泊松Poisson回归、GAM样条曲线模型对一个十字路口的骑自行车者的数量进行预测，

str(base)'data.frame': 214 obs.$ 日期 : chr "1-Apr" "2-Apr" "3-Apr7" "4-Apr" ...$ 最高温度 : num 46 62.1 63 51.1 63 48.9 48 55.9 66 73.9 ...$ 最低温度 : num 37 41 50 46 46 41 43 39.9 45 55 ...$ 降雨量 : num 0 0 0.03 1.18 0 0.73 0.01 0 0 0 ...$ 数量: int 606 2021 2470 723 2807 461 1222 1674 2375 3324 ...$ 温差 : num 9 21.1 13 5.1 17 7.9 5 16 21 18.9 ......

使用Poisson回归预测周日、周一有多少骑自行车的人，天气情况是温度85F-70F没有下雨。我们创建一个预测数据框。

newbase = data.frame(DAY=as.factor(最高温度=c(85,85),最低温度=c(70,70,降雨量=c(0,0))

让我们创建一个包含所有解释变量的模型。

我们还添加一个虚拟变量来指示不下雨的日子，

summary(reg)

Coefficients:Estimate Std. Error z value Pr(|z|)(Intercept) 6.8844970 0.0110463 623.241 2e-16 ***最高温度 0.0210950 0.0003133 67.328 2e-16 ***最低温度 -0.0114006 0.0003351 -34.024 2e-16 ***降雨量 -0.6570450 0.0071899 -91.384 2e-16 ***I(降雨量 == 0)TRUE 0.1303908 0.0033283 39.176 2e-16 ***

---Signif. codes: 0 ‘***’ 0.001 ‘**’ 0.01 ‘*’ 0.05 ‘.’ 0.1 ‘ ’ 1

(Dispersion parameter for poisson family taken to be 1)

Null deviance: 70021 on 213 degrees of freedomResidual deviance: 26493 on 203 degrees of freedomAIC: 28580

Number of Fisher Scoring iterations: 4

所以变量似乎都显著。如果我们要检查非线性效应，可以将样条曲线放在所有连续变量上

gam(数量~bs(最高温度)+bs(最低温度)+bs(降雨量)+I(降雨量==0),poisson

最高温度或最低温度

以及下面的降雨量曲线，最大观测值（3）与之前观测值（1.8）之间的线性平滑

我们还可以回归最小温度，以及最大和最小温度之间的温差（在线性模型中，模型是等效的，但是通过非线性变换，可以更简单地给出差异）

现在，我们可以比较这四个模型及其预测。例如，对于线性模型（虚拟变量表示没有下雨），

predict(reg,newdata=newbase,type="response se.fit=TRUE

对于星期一，我们获得λ的95％置信区间

P$fit[1]+c(-2,2)*P$se.fit[1][1] 3349.842 3401.395

对于星期日，95％置信区间为

[1] 2987.497 3033.861

我们可以可视化四个模型的置信区间

而周日，我们有

换句话说，通过更改模型，我们对预测的置信区间进行了更改（有时区间完全不相交）。

「发生次数」用什么方法搞定？：泊松回归与负二项回归。

转自个人微信公众号[Memo_Cleon]的统计学习笔记:"发生次数"用什么方法搞定?泊松回归与负二项回归. 关于泊松回归,还有一些问题需要再进一步地说明与示例. 交叉表实际上是经 ...
Log binomial 回归，几十年的老方法为什么不流行呢！

系列文章"log binomial and Poisson 回归" 1.时代变了,回归分析你还首选logistic回归吗?out了! 2.Poisson回归,研究离散事件的重要回归 ...
「原创」希腊的气候和雅典的天气

来希腊雅典定居生活八个多月了,我一直还在使用国内的墨迹天气,基本没有查阅过希腊本地机构发布的天气预报.今天,我决定花一点时间,主要基于希腊国家气象局官方网站的数据,系统介绍一下希腊的气候和雅典的天气情 ...
Poisson回归，研究离散事件的重要回归方法

第二篇 Poisson分布,中文一般翻译为泊松分布,通俗来说,指的是在一个极大人群.空间和时间范围内,观察对象某种现象发生数的分布. 比如,2020年浙江省某县区3000名新生儿中,有20例先神经管畸 ...
一文读懂加拿大

--------------- AD --------------- 生活在加拿大的新老移民朋友们越来越多,可是,即便是旅居加国几十年的老移民们也未必人人都对加拿大有多了解.今天,小编就带您简单了解一 ...
R语言深度学习Keras循环神经网络(RNN)模型预测多输出变量时间序列

原文链接:http://tecdat.cn/?p=23902 递归神经网络被用来分析序列数据.它在隐藏单元之间建立递归连接,并在学习序列后预测输出. 在本教程中,我们将简要地学习如何用R中的Keras ...
R语言泊松Poisson回归模型预测人口死亡率和期望寿命

原文链接:http://tecdat.cn/?p=18782 本文我们讨论了期望寿命的计算.人口统计模型的起点是死亡率表.但是,这种假设有偏差,因为它假设生活条件不会得到改善.为了正确处理问题,我们使 ...
R语言贝叶斯Poisson泊松-正态分布模型分析职业足球比赛进球数

原文链接:http://tecdat.cn/?p=23099 在本文关于如何在R中进行贝叶斯分析.我们介绍贝叶斯分析,这个例子是关于职业足球比赛的进球数. 模型首先,我们认为职业足球比赛的进球数来自 ...
R语言中的多项式回归、B样条曲线(B-spline Curves)回归

原文链接:http://tecdat.cn/?p=18129 在线性模型的文章中,我们已经了解了如何在给出协变量x的向量时构造线性模型.但更一般而言,我们可以考虑协变量的变换,来使用线性模型. 我们首 ...
R语言实现偏最小二乘回归法 partial least squares (PLS)回归

原文链接:http://tecdat.cn/?p=8652 偏最小二乘回归是一种回归形式 . 当使用pls时,新的线性组合有助于解释模型中的自变量和因变量. 在本文中,我们将使用pls在" ...
R语言用局部加权回归(Lowess)对logistic逻辑回归诊断和残差分析

原文链接:http://tecdat.cn/?p=22328 目前,回归诊断不仅用于一般线性模型的诊断,还被逐步推广应用于广义线性模型领域(如用于logistic回归模型),但由于一般线性模型与广义线 ...
R语言混合效应逻辑回归（mixed effects logistic）模型分析肺癌数据

原文链接:http://tecdat.cn/?p=22302 混合效应逻辑回归用于建立二元结果变量的模型,其中,当数据被分组或同时存在固定和随机效应时,结果的对数几率被建模为预测变量的线性组合. 混合 ...
R语言多元Logistic逻辑回归应用案例

原文链接:http://tecdat.cn/?p=2640 可以使用逐步回归过程确定多元逻辑回归.此函数选择模型以最小化AIC. 如何进行多元逻辑回归可以使用step函数通过逐步回归过程确定多元逻辑 ...
R语言惩罚logistic逻辑回归（LASSO,岭回归）高维变量选择的分类模型案例

原文链接:http://tecdat.cn/?p=21444 逻辑logistic回归是研究中常用的方法,可以进行影响因素筛选.概率预测.分类等,例如医学研究中高通里测序技术得到的数据给高维变量选择问 ...

R语言用泊松Poisson回归、GAM样条曲线模型预测骑自行车者的数量

原文链接：http://tecdat.cn/?p=18550

相关推荐