← 返回统计与数据判断力
学习进度4 / 6

列联表

Contingency table · ST3 分类变量的描述(Describing Categorical Data)

一句话定义

列联表是把两个分类变量交叉排列,统计每种组合出现次数的表格。

机制 / 原理

列联表把一个问题从“总体有多少”推进到“不同组里分别怎样”。行可以是一种分类变量,列可以是另一种分类变量,格子里是组合频数。它让我们看到关系的形状:某个结果是否集中在某类人、某渠道、某时段,而不是被总体比例平均掉。

列联表看交叉关系用户复购未复购新用户34166老用户92108合计126274列联表把两个分类变量的组合摊开。
列联表把两个分类变量的组合摊开。

经典实验 / 例子

研究性别与是否支持某政策时,列联表可以把男性/女性和支持/不支持交叉起来。单看总体支持率可能很平,分组后却可能看到不同群体的支持结构。

生活中的例子

一家网店把“新老用户”和“是否复购”做成列联表,就能看出复购主要来自老用户,还是新用户也在快速回访。

常见误区

常见误区是看到列联表某个格子最大,就直接判断关系强。格子频数受行列总数影响,真正比较通常要转成行比例或列比例。

资料来源:OpenIntro Statistics; CMU OLI Statistical Reasoning; Online Statistics Education; OpenStax Introductory Statistics 2e,课程内容为原创改写 · 第 ST3
本讲解由 AI 依据该教材与主流学术观点撰写,非逐字引用,仅供学习参考。