拓端tecdat|R语言辅导stan进行贝叶斯推理分析

时间：2022-12-11 17:02:39浏览次数：87

标签：后验模型 tecdat 贝叶斯 Stan 拓端 stan 0.95

R语言stan进行贝叶斯推理分析

R的Stan

可以从许多统计软件包中运行Stan。到目前为止，我一直在从R运行Stan，首先按照快速入门指南中的说明安装并运行所有内容。

简单线性回归

第一步是为Stan模型编写文件。这包含一个文件linreg.stan：

data { int N;  [N] x; vector[N] y; } parameters { real alpha; real beta; real sigma; } model { y ~ normal(  + beta * x, sigma); }

拓端tecdat|R语言辅导stan进行贝叶斯推理分析_数据

该文件的第一部分称为数据，它声明了将作为输入传递给Stan的标量，向量和矩阵。

接下来，我们可以通过运行以下R代码来模拟数据集，并使用Stan和我们的文件linreg.stan来拟合模型：

set.seed(123) n <- 100 x <- rnorm(n) y <- x+ (n) mydata <- list(N = n, y = y, x= ) fit <- stan(file = 'linreg. ', data = mydata, iter = 1000,   = 4)

拓端tecdat|R语言辅导stan进行贝叶斯推理分析_Stan_02

第一次安装Stan模型时，模型编译成C ++时会有几秒钟的延迟。然而，正如Stan的开发人员描述的那样，一旦编译了模型，就可以将其应用于新的数据集而无需重复编译过程（在执行模拟研究的背景下具有很大的优势。

在上面的代码中，我们要求Stan运行4个独立的链，每个链有1000次迭代。运行后，我们可以通过以下方式汇总输出：

fit Inference for Stan model: linreg. 4 chains, each with iter=1000; warmup=500; thin=1; post-warmup draws per chain=500, total post-warmup draws=2000. mean se_mean sd 2.5% 25% 50% 75% 97.5% n_eff Rhat alpha -0.10 0.00 0.10 -0.29 -0.16 -0.10 -0.04 0.09 1346 1 beta 0.95 0.00 0.11 0.75 0.88 0.95 1.02 1.17 1467 1 sigma 0.98 0.00 0.07 0.85 0.93 0.98 1.03 1.12 1265 1 lp__ -47.54 0.06 1.24 -50.77 -48.02 -47.24 -46.68 -46.17 503 1 Samples were drawn using NUTS(diag_e) at Mon Jun 08 18:35:58 2015. For each parameter, n_eff is a crude measure of effective sample size, and Rhat is the potential scale reduction factor on split chains (at convergence, Rhat=1).

拓端tecdat|R语言辅导stan进行贝叶斯推理分析_数据_03

对于回归斜率β，我们的后验均值为0.95（接近用于模拟数据的真实值1）。为了形成95％的后可信区间，我们简单地采用取样后部的2.5％和97.5％的百分位数，这里是0.75到1.17。

您可以从拟合的模型中获取各种其他数量。一种是绘制其中一个模型参数的后验分布。要获得回归斜率，我们可以执行以下操作：

result <- extract(fit) hist(result$beta)

拓端tecdat|R语言辅导stan进行贝叶斯推理分析_拟合_04

β的后验分布直方图

拓端tecdat|R语言辅导stan进行贝叶斯推理分析_Stan_05

拓端tecdat|R语言辅导stan进行贝叶斯推理分析_拟合_06

现在让我们使用标准普通最小二乘拟合线性模型：

summary(lm(y~x)) Call: lm(formula = y ~ x) Residuals: Min 1Q Median 3Q Max -1.9073 -0.6835 -0.0875 0.5806 3.2904 Coefficients: Estimate Std. Error t value Pr(>|t|) (Intercept) -0.10280 0.09755 -1.054 0.295 x 0.94753 0.10688 8.865 3.5e-14 *** --- Signif. codes: 0 ‘***’ 0.001 ‘**’ 0.01 ‘*’ 0.05 ‘.’ 0.1 ‘ ’ 1 Residual standard error: 0.9707 on 98 degrees of freedom Multiple R-squared: 0.4451, Adjusted R-squared: 0.4394 F-statistic: 78.6 on 1 and 98 DF, p-value: 3.497e-14

拓端tecdat|R语言辅导stan进行贝叶斯推理分析_拟合_07

这给出了我们对斜率0.95的估计，与Stan的后验平均值相差2位小数，标准误差为0.11，这与Stan的后验SD相同。

stan和贝叶斯推理

有兴趣探索Stan并使用它来执行贝叶斯推理，这是出于测量误差和数据缺失的问题。正如多年前WinBUGS和其他人的作者所描述和展示的那样，贝叶斯方法在解决不同的不确定性来源问题时非常自然，这些不确定性来源超出参数不确定性，例如缺失数据或用误差测量的协变量。实际上，对于缺失数据的流行的多重插补方法是在贝叶斯范式内发展的，并且实际上可以被视为对完整贝叶斯分析的近似。

如果您有任何疑问，请在下面发表评论。

标签：后验,模型,tecdat,贝叶斯,Stan,拓端,stan,0.95
From： https://blog.51cto.com/u_14293657/5928408

拓端tecdat|动漫《那年那兔那些事儿》弹幕爬虫采集代写数据分析
开启弹幕已经成为很多年轻人看剧时的一种习惯。最近大热的几部电视剧，弹幕也十分精彩有趣，甚至出现“弹幕比剧好看”的现象。▼弹幕的出现消解了观影的孤独感，增加了互动性。可......
拓端数据|用R语言软件估计光谱密度
任何时间序列都可以表示为在谐波频率上振荡的余弦和正弦波之和= j/n，其中j =1,2，...，n /2。周期图给出了关于各种频率的相对强度的信息，用于解释时间序列的变化。周......
拓端数据tecdat|GIS代写遥感数据可视化评估：印度河流域上部的积雪面积变化
该研究是在2001年至2014年的MODISTerra（MOD10A2）数据的基础上在Satluj河流域上部进行的。已经注意到Satluj河流域这一部分的年平均SCA从44占总面积16,650平方公里的平均......
拓端数据tecdat|matlab代写利用PLSR和支持向量回归分析红树林叶面化学的高光谱分析
高光谱遥感能够实现冠层生化特性的大规模绘图。本研究探讨了从印度尼西亚Berau三角洲的红树林中回收氮，磷，钾，钙，镁和钠浓度的可能性。该研究的目的是（1）评估叶面化学检索的准确......
拓端tecdat|R语言非线性回归nls探索分析河流阶段性流量数据和评级曲线、流量预测可视
原文出处：拓端数据部落公众号本文档通过一些探索性数据分析来制定河流的评级曲线和流量预测。目的是利用(1)在底部安装单元的定期部署期间测量的瞬时流量和(2)来自长期......
拓端tecdat|python贝叶斯随机过程：马尔可夫链Markov-Chain，MC和Metropolis-Hastings，MH采
介绍本文，我们说明了贝叶斯学习和计算统计一些结果。 frommathimportpi frompylabimport*马尔可夫链的不变测度考虑一个高斯AR(1)过程，，其中是标准高......
拓端tecdat|R语言模拟ARCH过程模型分析时间序列平稳性、波动性
在事物的发展过程中，常表现出复杂的波动情况，即时而波动的幅度较缓，而又时常出现波动集聚性(VolatilitYclustering),在风险研究中经常遇到这种情况。恩格尔(Engle)在1982年提......
拓端tecdat|matlab代写的Lorenz系统仿真可视化
基于matlab的Lorenz系统仿真可视化我使用MATLAB解决以下Lorenz初始值问题：我编写了一个函数LorenzRK4IVP（），该函数将三个微分方程组作为输入，并使用......
拓端tecdat|R语言编程指导用关联规则和聚类模型挖掘处方数据探索药物配伍中的规律
R语言用关联规则和聚类模型挖掘处方数据探索药物配伍中的规律概要方剂药效与剂量的关系中药不传之秘在于剂量中药配伍规律。拓端数据使用数据挖......
拓端tecdat|R语言编程指导使用二元回归将序数数据建模为多元GLM
R语言使用二元回归将序数数据建模为多元GLM 用于分析序数数据的最常见模型是逻辑模型。本质上，您将结果视为连续潜在变量的分类表现。此结果的预......