UCIe基础学习2:die-to-die 协议生态地图——UCIe/BoW/AIB 与私有方案的选型账
2026/8/16 15:47:45
概率论为人工智能提供了处理不确定性和从数据中进行统计推断的数学语言。在这一框架下,随机变量及其概率分布构成了描述数据生成机制和模型不确定性的基石。在机器学习与人工智能领域,某些分布因其良好的数学性质和对现实世界现象的广泛适用性而占据核心地位。其中,高斯分布和伯努利分布是两类最基本且重要的分布,分别适用于连续型和离散型数据。此外,通过组合简单分布构建的混合模型,为建模复杂、多模态的数据结构提供了强大工具。本节将首先形式化随机变量的概念,随后深入探讨高斯分布与伯努利分布的定义、性质及其在AI中的角色,最后阐述混合分布的原理与意义。
随机变量是将随机试验的结果映射到实数(或更一般的数学对象)的函数。它为不确定性的量化提供了载体。
形式化定义:给定一个概率空间(Ω,F,P)(\Omega, \mathcal{F}, P)(Ω,F,P),其中Ω\OmegaΩ是样本空间,F\mathcal{F}F是事件σ\sigmaσ-代数,PPP是概率测度。一个随机变量XXX是一个从Ω\OmegaΩ到实数集R\mathbb{R}R的可测函数:X:Ω→RX: \Omega \to \mathbb{R}X:Ω→R。这使得我们可以谈论XXX落入某个实数区间BBB的概率,即P(X∈B)=P({ ω∈Ω:X(ω)∈B})P(X \in B) = P(\{\omega \in \Omega: X(\omega) \in B\})P(X∈B)=P({ω∈Ω:X(ω)∈B})[1]。
分布函数与概率密度/质量函数: