📑 查看全课大纲(第 24 / 41 节)
- 1.数理统计中的基本概念
- 2.统计量与抽样分布(一)
- 3.统计量与抽样分布(二)
- 4.次序统计量
- 5.充分统计量与完备统计量
- 6.统计中常用分布族(一)
- 7.统计中常用分布族(二)
- 8.矩估计
- 9.极大似然估计
- 10.无偏估计与一致最小方差无偏估计(一)
- 11.无偏估计与一致最小方差无偏估计(二)
- 12.完备统计量
- 13.CR不等式及有效估计
- 14.相合估计
- 15.置信区间
- 16.正态总体参数的置信区间
- 17.大样本置信区间
- 18.Fisher显著性检验
- 19.正态总体参数的假设检验(一)
- 20.正态总体参数的假设检验(二)
- 21.似然比检验
- 22.Neyman-Pearson基本引理
- 23.一致最优势检验
- 24.无偏检验与一致最优势无偏检验
- 25.正态概率纸检验
- 26.拟合优度检验
- 27.列联表的独立性检验
- 28.Kolmogorov检验
- 29.正态性检验
- 30.Bayes统计
- 31.先验分布的确定
- 32.Bayes统计推断
- 33.统计判决理论
- 34.Minimax准则
- 35.非参数统计
- 36.符号检验
- 37.Wilcoxon符号秩检验
- 38.抽样调查
- 39.简单随机抽样
- 40.分层随机抽样
- 41.整群随机抽样
无偏检验与一致最优势无偏检验
约 23 分钟
无偏检验与一致最优势无偏检验
小象实战讲义 · 数据科学的统计基础
在之前的章节中,我们学习了如何寻找最优检验(MP检验)和一致最优势检验(UMP检验)。然而,这些“最优”检验仅在特定条件下存在,例如简单假设对简单备择,或单边复合假设。当面对更普遍的双边假设检验问题时,UMP检验往往不存在。本节将引入“无偏检验”的概念,通过限制检验类,在无偏检验类中寻找最优者,即“一致最优势无偏检验”(UMPUT)。学完本节,你将理解为何需要引入无偏性约束,掌握UMPUT的构造方法,并能将其应用于常见的双边检验问题,例如正态总体均值的双边检验。
💡 核心导读
- 为何需要无偏检验? 在双边假设检验中,一致最优势检验(UMPT)通常不存在。借鉴估计理论中“限制为无偏估计类以寻找最小方差无偏估计(UMVUE)”的思想,我们通过限制检验为“无偏检验”来确保最优检验的存在性。
- 无偏检验的定义:一个检验被称为水平为 的无偏检验,不仅要求其在原假设下犯第一类错误的概率不超过 ,还要求其在备择假设下的势函数(检出能力)不低于 。这保证了检验在备择假设下不会比随机猜测更差。
- 一致最优势无偏检验(UMPUT):在所有水平为 的无偏检验中,如果存在一个检验,其势函数在备择参数空间的每一点上都最大,则该检验称为UMPUT。
- 单参数指数族中的UMPUT:对于单参数指数族分布,其双边假设检验问题存在UMPUT,且其形式与UMPT类似,但拒绝域的边界由势函数无偏性条件(导数条件)确定。
- 假设检验的延伸:理解假设检验与区间估计的对偶关系,以及P值的概念与计算,是完整掌握假设检验思想的重要环节。
从最优检验的局限性到无偏检验的引入
在假设检验的理论框架中,我们追求“最优”的检验。Neyman-Pearson引理为我们提供了简单假设对简单备择下的最优势检验(MP检验)。进一步,对于具有单调似然比(MLR)的单参数指数族,我们可以构造出单边复合假设的一致最优势检验(UMP检验)。
然而,当我们面对如下形式的双边假设检验问题时: 或更一般的 一致最优势检验(UMPT)往往不存在。这是因为,一个在 时势函数很大的检验,可能在 时势函数很小,反之亦然,无法在全部备择空间 上同时达到最优。
这类似于参数估计中的困境:我们希望找到一个估计量 ,使其均方误差(MSE) 最小。但MSE同时包含了方差和偏差的平方(),一个全局MSE最小的估计量通常难以求得。
估计理论的解决方案是:限制估计类。我们只在无偏估计类中寻找方差最小的那个,即一致最小方差无偏估计(UMVUE)。这样,最优解(UMVUE)的存在性就得到了保证。
假设检验沿用了同样的思路:当UMP检验不存在时,我们限制检验类。我们只在无偏检验类中寻找势函数最大的那个,即一致最优势无偏检验(UMPUT)。
无偏检验与一致最优势无偏检验的定义
无偏检验
考虑一般的假设检验问题: 其中 。
设 是该问题的一个检验函数,其势函数为 。
定义(无偏检验):如果检验 满足:
- (水平为 )。
- 。
则称 是水平为 的一个无偏检验。
解读:
- 条件1是常规的显著性水平要求,控制第一类错误。
- 条件2是“无偏性”的核心:它要求检验在备择假设下的检出能力(势函数)至少不低于显著性水平 。一个势函数低于 的检验,意味着当 为真时,它做出正确判断(拒绝 )的概率甚至还不如随机决策(以概率 拒绝),这样的检验是无效的,我们称其为“有偏”的。无偏性保证了检验在备择假设下不是无效的。
一致最优势无偏检验
定义(一致最优势无偏检验,UMPUT):对于上述假设检验问题,如果存在一个水平为 的无偏检验 (\mathbf{X}),使得对任何其他水平为 的无偏检验 ,都有 }(\theta) \ge g_{\phi}(\theta), \quad \forall \theta \in \Theta_1 则称 是该问题的一个水平为 的一致最优势无偏检验,记为UMPUT(Uniformly Most Powerful Unbiased Test)。
单参数指数族中的UMPUT
对于一大类常见的分布——单参数指数族,其双边假设检验的UMPUT存在且有明确的构造形式。
定理(单参数指数族双边检验的UMPUT):设样本 来自单参数指数族分布,其密度函数(或概率函数)为: 其中 是实参数, 是 的严格单调增函数(不失一般性,以下假设 严格递增), 为分布的支撑集,且与 无关, 为支撑集上的非负函数, 为充分统计量。
考虑双边假设:
- 。
- 或 (单边情形,UMPT存在)。
- 。
对于假设1,存在水平为 的UMPUT,其检验函数为: 其中常数 和 由以下方程确定: 对于连续型分布,通常有 ,检验退化为非随机化检验。
注记:
- 拒绝域形式与单边UMP检验不同,它是双侧的( 过小或过大都拒绝 )。
- 确定常数的两个方程有明确的统计含义:第一个是水平条件,控制第一类错误概率为 ;第二个是无偏性条件 (势函数在 处导数为零),这是局部最优性的体现,确保了检验在 附近也是“公平”的。
- 对于假设3,其UMPUT的形式与假设1类似,但确定常数的方程需满足在边界 和 处的水平与无偏性条件。
应用示例:正态总体均值的双边检验
我们通过两个经典例子来演示UMPUT的构造。
示例1:方差已知时,均值的双边检验
设 ,其中 已知。考虑假设:
化为指数族形式:正态分布 的密度为: 令 , , , , 。这是一个单参数指数族,且 关于 严格递增。样本充分统计量为 或等价的 。
构造UMPUT:根据定理,UMPUT基于 。由于 连续,我们采用非随机化检验。其拒绝域形式为: 或 。
确定常数:在 下,。由对称性和无偏性条件 \phi(\mu_0)=0,通常取 和 关于 对称,即 , 。 水平条件为: {\mu_0}(|\bar{X} - \mu_0| > \delta) = \alpha 标准化后: 由于 ,可得 ,即 。这里 是标准正态分布的 分位数。
最终检验:水平为 的UMPUT为: 这正是我们熟知的双边Z检验。
示例2:方差未知时,均值的双边检验(t检验)
设 , 未知。考虑假设: 此时参数为 ,是两参数的。但若将 视为讨厌参数,可以证明,基于t统计量的检验在所有水平为 的无偏检验中是一致最优的(UMPUT,一致最优无偏检验)。其检验统计量为: 其中 为样本方差。在 下,(自由度为 的t分布)。
水平为 的UMPUT(即双边t检验)的拒绝域为: 其中 是 分布的 分位数。
import numpy as np
import scipy.stats as stats
# 模拟示例:方差未知时正态均值的双边t检验 (UMPUT)
np.random.seed(321) # 固定随机种子
mu0 = 100 # 原假设均值
sigma = 15 # 真实标准差(未知)
n = 30 # 样本量
alpha = 0.05 # 显著性水平
# 生成一组样本,假设真实均值 mu_true = 105
mu_true = 105
sample = np.random.normal(loc=mu_true, scale=sigma, size=n)
# 计算样本均值、样本标准差和t统计量
x_bar = np.mean(sample)
s = np.std(sample, ddof=1) # 无偏估计,自由度 n-1
t_stat = np.sqrt(n) * (x_bar - mu0) / s
# 计算临界值和p值
t_critical = stats.t.ppf(1 - alpha/2, df=n-1)
p_value = 2 * (1 - stats.t.cdf(np.abs(t_stat), df=n-1)) # 双边p值
print(f"样本均值 x̄ = {x_bar:.4f}")
print(f"样本标准差 s = {s:.4f}")
print(f"t 统计量 = {t_stat:.4f}")
print(f"t 分布临界值 (α={alpha}, 双边) = ±{t_critical:.4f}")
print(f"p 值 = {p_value:.6f}")
# 做出检验决策
if np.abs(t_stat) > t_critical:
print(f"决策:|t| = {np.abs(t_stat):.4f} > {t_critical:.4f},拒绝 H0 (μ = {mu0})。")
else:
print(f"决策:|t| = {np.abs(t_stat):.4f} ≤ {t_critical:.4f},不拒绝 H0 (μ = {mu0})。")
# 验证:p值 < α 等价于拒绝 H0
if p_value < alpha:
print("根据p值决策:p值 < α,拒绝 H0。")
else:
print("根据p值决策:p值 ≥ α,不拒绝 H0。")延伸内容:对偶关系与P值
作为假设检验章节的收尾,我们补充两个紧密相关的重要概念。
假设检验与区间估计的对偶关系
假设检验和区间估计在本质上是对偶的。一个显著性水平为 的假设检验,可以导出一个置信水平为 的置信区间,反之亦然。
对偶关系:考虑参数 的假设检验问题 vs 。设该检验的接受域为 ,即当样本落在 内时不拒绝 。那么,参数 的置信水平为 的置信区间 可以通过“收集所有不能被当前样本拒绝的 ”来构造: 反之,给定一个置信区间 ,可以构造一个检验:当且仅当 时拒绝 。
示例回顾:在方差已知的正态总体均值检验中, 的接受域为 。对应的置信区间正是 的 置信区间:。
P值:观测到的显著性水平
P值提供了做假设检验的另一种方式,它比固定 的拒绝域方法更灵活。
定义(P值):在一个假设检验问题中,P值是指在原假设 成立的前提下,获得与当前样本相同或更极端(更不利于 )的检验统计量取值的概率。
作用:
- 决策:若 ,则拒绝 ;否则不拒绝。这等价于使用拒绝域的方法。
- 提供证据强度:P值越小,表明当前样本数据与原假设矛盾的程度越大,拒绝 的证据越强。它报告了“观测到的显著性水平”。
- 反映第一类错误真实概率:对于当前给定的样本,P值可以理解为“若以当前样本结果作为临界点,所犯第一类错误的最小概率”。
计算(以双边Z检验为例):若观测到的检验统计量值为 ,则双边检验的P值为: 其中 , 是其分布函数。
# 演示P值的计算与含义(接续前一个代码块的样本)
# 我们已经计算了t检验的p值。现在用模拟来理解P值的含义:它是“更极端”结果出现的概率。
np.random.seed(321)
n_simulations = 10000
# 在原假设 H0: mu = 100 下生成模拟样本
simulated_t_stats = []
for _ in range(n_simulations):
sim_sample = np.random.normal(loc=mu0, scale=sigma, size=n) # 按H0生成
sim_x_bar = np.mean(sim_sample)
sim_s = np.std(sim_sample, ddof=1)
sim_t = np.sqrt(n) * (sim_x_bar - mu0) / sim_s
simulated_t_stats.append(sim_t)
simulated_t_stats = np.array(simulated_t_stats)
# 计算模拟中|t| >= |t_obs|的比例,这应近似于我们计算的理论p值
empirical_p = np.mean(np.abs(simulated_t_stats) >= np.abs(t_stat))
print(f"\n--- P值的模拟验证 ---")
print(f"基于当前样本计算的理论p值: {p_value:.6f}")
print(f"通过{int(n_simulations)}次模拟(H0为真),|t| >= |{t_stat:.4f}| 的比例: {empirical_p:.6f}")
print(f"两者接近,说明P值确实是在H0下,出现当前或更极端情况的概率。")📝 动手练一练
无偏性的理解:设有一个检验问题 vs ,其势函数为 (假设 )。取显著性水平 。
- a) 这个检验是水平为 0.25 的检验吗?
- b) 这个检验是无偏检验吗?为什么?
UMPUT的构造:设 ,即指数分布,密度为 。考虑检验问题 vs 。
- a) 将该分布写成单参数指数族形式,指出 , 和充分统计量 。
- b) 根据UMPUT定理,拒绝域应基于哪个统计量?其大致形式是什么?(无需求解具体常数)
参考答案:
- a) 是。因为当 ()时,,满足水平要求。 b) 不是无偏检验。因为当 接近0但属于 (例如 )时,,不满足无偏性条件 。这个检验在备择假设的某些部分表现比随机猜测还差。
- a) 。令 ,则 , , (),。充分统计量为 。 b) 拒绝域应基于 。其形式为: 或 ,其中常数 由水平条件和无偏性条件确定。由于指数分布是单参数指数族且 是线性的,该UMPUT存在。
本章小结
本节是假设检验理论部分的收官之作,我们探讨了当“全局最优”的一致最优势检验(UMPT)不存在时,如何通过引入“无偏性”约束,在更合理的“无偏检验类”中寻找最优解,即一致最优势无偏检验(UMPUT)。
- 核心思想:借鉴估计理论中“限制无偏以求得UMVUE”的思路,通过要求检验在备择假设下的势函数不低于显著性水平 ,定义了无偏检验,从而确保了在无偏类中最优检验(UMPUT)的存在性。
- 关键定理:对于单参数指数族分布,其双边假设检验问题存在UMPUT,其形式是基于充分统计量的双侧拒绝域,边界常数由水平条件和势函数在边界点导数为零的无偏性条件共同决定。
- 典型应用:正态总体均值在方差已知时的双边Z检验,以及方差未知时的双边t检验,都是UMPUT的具体体现。
- 延伸理解:假设检验与区间估计存在深刻的对偶关系,两者可以相互转化。P值则提供了比固定拒绝域更灵活的检验报告方式,它量化了数据反对原假设的证据强度。
行动清单
- 概念辨析:清晰区分MP检验、UMP检验和UMPUT的适用条件与关系。问自己:什么时候UMP检验不存在?为什么需要无偏性?
- 动手验证:运行讲义中的Python代码,理解t检验作为UMPUT的实现,并通过模拟验证P值的统计含义。
- 建立联系:回顾第三章区间估计的内容,任选一个置信区间(如正态均值的区间),尝试构造出其对偶的假设检验问题,并写出检验规则,体会两者之间的等价性。
— 小象教研组
- 第4章课件:假设检验(PDF · 7.6MB)下载
领取《小象 11GB VIP 课件资料包与大厂真题手册》
包含全套实战 Jupyter 源码、清洗后数据集、大厂高频面试真题与专属学员答疑交流群。
- ✔完整 Python / 数据分析 Jupyter 实战源码
- ✔大厂真实业务数据集与练习题
- ✔微信扫码添加课程顾问,免费获取网盘下载链接
微信扫码添加顾问