leetcode算法题第四题:寻找两个正序数组的中位数
题目:
给定两个大小分别为 m 和 n 的正序(从小到大)数组 nums1 和 nums2。请你找出并返回这两个正序数组的中位数 。
算法的时间复杂度应该为 O(log (m+n))
解题思路:二分查找法
如何把时间复杂度降低到 O(log(m+n)) 呢?如果对时间复杂度的要求有log,通常都需要用到二分查找,这道题也可以通过二分查找实现。
根据中位数的定义,当 m+n 是奇数时,中位数是两个有序数组中的第 (m+n)/2 个元素,当 m+n是偶数时,中位数是两个有序数组中的第 (m+n)/2 个元素和第 (m+n)/2+1 个元素的平均值。因此,这道题可以转化成寻找两个有序数组中的第 k 小的数,其中 k 为 (m+n)/2(m+n)/2或 (m+n)/2+1(m+n)/2+1。
假设两个有序数组分别是 A 和 B。要找到第 k个元素,我们可以比较 A[k/2−1] 和B[k/2−1],其中 // 表示整数除法。由于A[k/2−1] 和B[k/2−1] 的前面分别有A[0..k/2−2] 和B[0..k/2−2],即 k/2−1 个元素,对于 A[k/2−1] 和B[k/2−1] 中的较小值,最多只会有 (k/2-1)+(k/2-1)≤k−2 个元素比它小,那么它就不能是第 k 小的数了。
因此我们可以归纳出三种情况:
1.如果 A[k/2−1]<B[k/2−1],则比A[k/2−1] 小的数最多只有 A 的前 k/2−1 个数和B 的前 k/2−1 个数,即比A[k/2−1] 小的数最多只有 k-2个,因此A[k/2−1] 不可能是第 k 个数,A[0] 到 A[k/2−1] 也都不可能是第 k个数,可以全部排除。
2.如果 A[k/2−1]>B[k/2−1],则可以排除 B[0] 到 B[k/2−1]。
3.如果A[k/2−1]=B[k/2−1],则可以归入第一种情况处理。
可以看到,比较A[k/2−1] 和 B[k/2−1] 之后,可以排除 k/2 个不可能是第 k 小的数,查找范围缩小了一半。同时,我们将在排除后的新数组上继续进行二分查找,并且根据我们排除数的个数,减少 k的值,这是因为我们排除的数都不大于第 k 小的数。
有以下三种情况需要特殊处理:
1.如果A[k/2−1] 或者 B[k/2−1] 越界,那么我们可以选取对应数组中的最后一个元素。在这种情况下,我们必须根据排除数的个数减少 k 的值,而不能直接将 k 减去 k/2
2.如果一个数组为空,说明该数组中的所有元素都被排除,我们可以直接返回另一个数组中第 k小的元素。
3.如果 k=1,我们只要返回两个数组首元素的最小值即可。