最大似然估计（MLE）

最新推荐文章于 2024-08-13 12:53:37 发布

qq_43348120

最新推荐文章于 2024-08-13 12:53:37 发布

阅读量1.5k

点赞数 1

本文链接：https://blog.csdn.net/qq_43348120/article/details/82955629

版权

最大似然估计（MLE）是一种统计方法，用于求解样本集相关概率密度函数的参数。该方法寻找能产生观测数据的最高概率模型，常用于系统发生树重建。在数学上，MLE通过最大化可能性函数来确定参数估计。尽管MLE可能具有偏差，但在大样本量下，它具有最小方差并趋向于正态分布。MLE在数据分析和决策过程中提供了一种求解最优解的途径。

摘要由CSDN通过智能技术生成

概述编辑:
最大似然估计是一种统计方法，它用来求一个样本集的相关概率密度函数的参数。这个方法最早是遗传学家以及统计学家罗纳德·费雪爵士在1912年至1922年间开始使用的。
“似然”是对likelihood 的一种较为贴近文言文的翻译，“似然”用现代的中文来说即“可能性”。故而，若称之为“最大可能性估计”则更加通俗易懂。
最大似然法明确地使用概率模型，其目标是寻找能够以较高概率产生观察数据的系统发生树。最大似然法是一类完全基于统计的系统发生树重建方法的代表。该方法在每组序列比对中考虑了每个核苷酸替换的概率。
例如，转换出现的概率大约是颠换的三倍。在一个三条序列的比对中，如果发现其中有一列为一个C，一个T和一个G，我们有理由认为，C和T所在的序列之间的关系很有可能更接近。由于被研究序列的共同祖先序列是未知的，概率的计算变得复杂；又由于可能在一个位点或多个位点发生多次替换，并且不是所有的位点都是相互独立，概率计算的复杂度进一步加大。尽管如此，还是能用客观标准来计算每个位点的概率，计算表示序列关系的每棵可能的树的概率。然后，根据定义，概率总和最大的那棵树最有可能是反映真实情况的系统发生树。
原理编辑
给定一个概率分布D，假定其概率密度函数（连续分布）或概率聚集函数（离散分布）为fD，以及一个分布参数θ，我们可以从这个分布中抽出一个具有n个值的采样X1,X2,…,Xn，通过利用fD，我们就能计算出其概率：

但是，我们可能不知道θ的值，尽管我们知道这些采样数据来自于分布D。那么我们如何才能估计出θ呢？一个自然的想法是从这个分布中抽出一个具有n个值的采样X1,X2,…,Xn，然后用这些采样数据来估计θ。
一旦我们获得，我们就能从中找到