从 sgmediation 到 mediation:Stata 中介效应分析的范式升级与实战指南
如果你在 Stata 里做过中介效应分析,大概率用过 sgmediation 这个命令。它简单、直接,一度是许多研究者的首选。但当你需要将结果呈现在一篇严谨的学术论文,尤其是面对审稿人关于“未观测混杂”的质询时,sgmediation 的局限性就暴露无遗——它无法告诉你,你的中介效应结果到底有多“稳健”。
这正是我们今天要讨论的 mediation 包(Stata 官方命令为 medeff 和 medsens)的核心价值所在。它不仅仅是一个替代品,更代表了一种分析范式的升级:从简单的效应检验,转向对效应可靠性和敏感性的深度评估。这套由 Kosuke Imai 等学者开发的工具,早已在 R 语言社区被广泛验证,如今其 Stata 版本也已登上 Stata Journal,成为追求发表级分析质量的研究者不可或缺的利器。本文将带你彻底告别旧有习惯,完整掌握这套新工具,从安装、基础分析到绘制专业的敏感性分析图,一步步构建更坚实、更具说服力的实证证据。
1. 为何需要超越 sgmediation?理解中介效应分析的深层挑战
sgmediation 命令基于经典的 Baron and Kenny (1986) 逐步法框架,其逻辑清晰易懂:先检验 X 对 M 的效应(路径 a),再检验 M 对 Y 的效应(路径 b),最后检验 X 对 Y 的直接效应(路径 c')。如果 a 和 b 显著,且 c' 的绝对值小于总效应 c,则存在中介效应。
这个方法直观,但存在几个根本性的局限:
- 因果推断的脆弱性:逐步法本质上是一系列回归的叠加,它严重依赖于一个强假设——不存在未观测的混淆变量。也就是说,除了我们控制的协变量,没有其他因素同时影响中介变量 M 和结果变量 Y。在实际社会科学研究中,这个假设几乎不可能完全满足。
- 缺乏对效应“稳健性”的量化:
sgmediation告诉你效应“是否存在”(基于统计显著性),但无法回答“这个效应有多可靠”?如果存在一个未观测的混淆变量,需要它和 M、Y 的相关性达到多大,才能让我们的中介效应结论失效? - 对模型形式的灵活性不足:当结果变量 Y 是二分类、计数数据时,
sgmediation的处理不够优雅,而mediation包可以自然地处理logit、probit、poisson等多种模型。
mediation 包(通过 medeff 和 medsens 命令)的核心贡献,正是引入了 敏感性分析(Sensitivity Analysis)。它通过一个名为 ρ(rho) 的敏感性参数,量化未观测混淆的潜在影响。简单来说,ρ 衡量了未观测混淆变量与中介变量 M 的残差、以及与结果变量 Y 的残差之间的相关性。ρ=0 意味着没有未观测混淆(理想情况);ρ 的绝对值越大,说明需要存在的未观测混淆越强,才能推翻你的结论。
因此,一个完整的中介分析报告,不仅应汇报点估计值和置信区间,还应汇报:在多大的 ρ 值下,中介效应(ACME)的置信区间会包含 0。这为你的结论提供了透明的“稳健性证书”。
提示:敏感性分析并非要证明你的模型完美无缺,而是诚实地展示其结论对潜在假设偏离的承受能力。这在顶级期刊的审稿中越来越成为标配。
2. 环境搭建与数据准备:安装 medeff 并理解分析框架
2.1 命令安装与确认
mediation 包在 Stata 中的官方编号是 st0243。安装非常简单,无需手动下载文件。
* 方法一:通过 findit 命令查找并安装
findit medeff
* 在弹出的查看器中,找到 st0243 并点击链接安装。
* 或者,直接使用 ssc 命令安装(如果作者已上传至 SSC)
* ssc install st0243, replace
安装完成后,可以通过 help medeff 和 hel


396

被折叠的 条评论
为什么被折叠?



