教程 ·

ANCOVA 协方差分析怎么做?Type III、斜率同质性与调整均值

按 ChatSRS 当前 ANCOVA 分析器说明数据清理、Type III 平方和、回归斜率同质性、调整均值与 SE,以及三组以上 Bonferroni 或 LSD 两两比较和 95% 区间;同时披露同质性检验回退风险。

ChatSRS 当前的 ANCOVA 用 Type III 平方和,在控制一个或多个数值协变量后比较组别,并输出斜率同质性检查、主分析、调整均值与可选的组间两两比较。它不会替研究者证明协变量合理,也不会把异常回退当作可靠的前提证据。

本页只描述当前 ancova 分析器。下列字段名与占位符只是字段顺序模板,不是真实产品回执;请用本次真实输出替换,并逐项复核设计、样本、模型、warning 和数值。

什么时候适合考虑 ANCOVA

常见问题是:多个独立组在结果变量上是否仍有差异,同时希望在模型中控制前测、年龄或其他连续协变量。

进入模型前需要有可辩护的研究设计:

  • 因变量应是可作为连续数值处理的结果;
  • 分组变量应有至少两个实际水平;
  • 协变量应在结果发生前或具有明确理论地位;
  • 协变量不能只是因为与结果显著就临时加入;
  • 组别与协变量的关系、测量时点和因果顺序需要由研究者解释。

ANCOVA 调整的是给定模型下的组间比较,不会把非随机分组自动变成随机实验,也不会消除未测量混杂。

当前输入与清理规则

运行时需要明确指定:

  1. 一个分组变量;
  2. 一个因变量;
  3. 一个或多个协变量;
  4. 是否在三组及以上时执行两两比较;
  5. 两两比较使用 Bonferroni 还是 LSD。

因变量和协变量先转为数值,再对分组变量、因变量及全部协变量执行列表式删除。清理后少于 10 行会停止,分组水平少于两个也会停止。

列表式删除意味着任何一个所需字段缺失,该行都不会进入描述统计、同质性检验或主模型。报告中的 N 必须来自清理后数据,并说明原始行数与删除数量。

文本分组水平会保留为类别;数值协变量若整列不能转换,则本次模型不能继续。

当前输出由五部分组成

1. 原始描述统计

各组先显示:

  • N;
  • 因变量原始均值;
  • 因变量样本标准差。

协变量另列整体均值与样本标准差。这一部分描述的是未调整数据,不能把原始均值和后面的调整均值混为一列。

2. 回归斜率同质性

回归斜率同质性检验对每个协变量建立组别与协变量的交互项,并输出 SS、df、F、p 和文字结论。

标准 ANCOVA 主模型没有组别×协变量交互,因此这一检查是在问:各组的协变量斜率是否足够一致,是否还能用共同斜率解释调整结果。

需要注意两层边界:

  • p 未达到预设显著水平不等于证明所有组斜率完全相同;
  • 多协变量时,当前实现逐个协变量建立单独交互模型;该模型不同时控制其他协变量,也不是一次性检验所有交互项的联合模型。

必须披露的回退风险

如果斜率同质性检验内部失败或未找到交互项,当前实现会回退为 SS=0、df=0、F=0、p=1,并可能把表格结论显示为“满足”;这个回退不是假设满足的证据,必须结合 warning、模型秩和原始数据另行核验。

因此看到 0 / 0 / 0 / 1 组合时,不能把它写成前提已通过。正常的非显著检验也需要有实际自由度和可解释模型。

3. Type III ANCOVA 主表

主模型形式是“因变量 ~ 组别 + 协变量”,不包含交互。Type III 主表分别给出组别、各协变量和残差,并为可检验效应提供 SS、df、MS、F、p 与偏 η²。

Type III 平方和用于在模型其他项存在时评估当前效应;它不是“自动处理所有不平衡”的保证。类别编码、样本构成、协变量中心、模型设定和数据缺失都会影响解释。

偏 η²按效应平方和与残差平方和计算。它描述当前模型中的效应量,不代表因果效应,也不能只凭固定阈值判定实际重要性。

4. 调整均值

每个协变量会固定在本次完整案例中的总体均值,然后用拟合模型预测各组结果。调整均值表返回调整均值与 SE,不提供调整均值的置信区间(CI)。

所以页面不能把“调整均值 ± SE”改写成“调整均值的 95% CI”。如果研究规范要求每组调整均值区间,需要另行从经过核验的预测结果计算。

调整均值依赖共同斜率和模型形式。斜率同质性证据不足、存在强非线性或外推时,即使表格能算出数值,也不能机械解释。

5. 三组以上的两两比较

三组及以上且启用事后比较时,当前支持 Bonferroni 或 LSD,并返回均值差、SE、t、p 与两两差异的 95% 置信区间(CI)。

当前不提供 Tukey。两组设计不生成这部分表格,关闭事后比较也不会生成。

还要注意:

  • 比较方向是“组 1 - 组 2”,交换顺序会改变均值差符号;
  • Bonferroni 只对 p 值乘以比较数量并封顶为 1;
  • 当前 95% 区间用常规 t 临界值形成,不应写成已经同步做过 Bonferroni 区间校正;
  • LSD 模式的 p 值不做多重校正;
  • 结果不因主组别效应是否显著而自动开关,只取决于组数与 post_hoc 参数。

如果精确线性对比构造失败,分析器会写出 warning,并回退为近似 SE,再据此计算近似 t、p 和 95% CI;看到 warning 时不得把这组近似结果当作精确对比结果。第一层近似把两个组预测均值的 SE 平方相加后开根号;若预测 SE 也无法取得,则再用残差均方与两组样本量近似。页面当前不会把“精确对比”与“近似回退”另设字段,所以报告前必须保留并核对运行日志。

原始均值、调整均值和两两差异不要混写

结果当前字段回答的问题
原始描述N、原始均值、SD清理后各组实际观察到什么
调整均值调整均值、SE协变量固定在总体均值时模型预测什么
两两比较均值差、SE、t、p、差异区间两个调整后组预测之间相差多少

单组调整均值的 SE 不是两组差异的 SE;单组调整均值也没有当前输出的区间。论文表格应保持这三类字段来源可追溯。

一个可复核的 ANCOVA 流程

  1. 先说明研究设计:为什么比较这些组,为什么控制这些协变量。
  2. 冻结变量角色:分组、因变量和协变量不能在看到结果后互换。
  3. 核对数值转换:因变量与协变量是否含文本、异常码或单位混杂。
  4. 记录列表式删除:保存原始行数、完整案例数和各组人数。
  5. 阅读原始描述:检查范围、离群和组别分布。
  6. 检查斜率同质性:同时看交互结果、自由度、warning 与回退特征。
  7. 解释 Type III 主表:按预先设定模型报告组别和协变量效应。
  8. 核对调整均值:确认协变量固定值及每组 SE。
  9. 需要时运行两两比较:三组以上明确选择 Bonferroni 或 LSD。
  10. 形成待核验草稿:只填写本次真实输出实际存在的字段。

ANCOVA 结果字段顺序模板

设计与数据:
- 因变量:[真实变量与量尺]
- 组别:[真实变量、水平与参照说明]
- 协变量:[真实变量与纳入理由]
- 缺失处理:所需变量列表式删除
- 完整案例 N 与各组 N:[真实输出]

斜率同质性:
- 每个组别×协变量交互的 SS、df、F、p:[真实输出]
- warning 或回退特征:[原样保留]
- 研究者复核结论:[不能只抄系统标签]

Type III 主表:
- 组别效应:[SS、df、MS、F、p、偏 η²]
- 协变量效应:[逐项真实输出]
- 残差:[SS、df、MS]

调整均值:
- 各组调整均值、SE:[真实输出]
- 协变量固定值:[本次完整案例总体均值]

三组以上且启用两两比较时:
- 方法:[Bonferroni / LSD]
- 组 1 - 组 2:[均值差、SE、t、p、差异的 95% CI]
- 精确线性对比 warning 与近似回退:[原样保留并复核]

待核验草稿:
“基于[真实 N]个完整案例,以[真实因变量]为结果、[真实组别]为分组,
并控制[真实协变量]运行 Type III ANCOVA。
斜率同质性结果为[真实交互结果及 warning 复核]。
组别主效应、调整均值与两两比较见[真实表号]。”

这个字段顺序不替代方法审查。任何固定阈值、显著性结论或因果措辞,都要由真实数据、研究设计和目标规范共同支持。

常见问题 FAQ

Q1:斜率同质性交互 p 较大,就能写“假设成立”吗?

不能只看 p。要先确认检验实际成功、自由度正常、没有回退 warning,再结合样本量、图形与模型设定判断证据。非显著结果表示当前检验没有发现足够的交互证据,不是逻辑上的相等证明。

Q2:为什么调整均值表没有 95% 区间?

当前表只输出预测调整均值与 SE。两两比较表的区间属于组间差异,不是每组调整均值区间,两者不能互换。

Q3:三组比较能选 Tukey 吗?

不能。当前 ANCOVA 入口只接受 Bonferroni 或 LSD。Tukey 是其他分析入口可能存在的方法,不能跨分析器推断为 ANCOVA 已支持。

Q4:前后测数据一定要用 ANCOVA 吗?

不一定。方法取决于研究问题、分配机制、测量次数、缺失结构和模型假设。若只是独立组的经典方差分析分流,可先查看单因素 ANOVA 的当前能力边界;重复测量或更复杂纵向结构需要另选并重新核验。

最后核对

  • 因变量和协变量的数值转换已经检查;
  • N 来自全部所需变量的列表式删除;
  • Type III 主表没有被写成含交互的模型;
  • 同质性回退没有被当作假设证据;
  • 调整均值表只有调整均值与 SE;
  • 三组以上的比较只写 Bonferroni 或 LSD;
  • 两两比较 warning 已复核,近似回退没有被写成精确线性对比;
  • Tukey 和自动论文成稿没有被补写;
  • 所有报告文字仍是待核验草稿。