暴力匹配算法 BF
如果用暴力匹配的思路,并假设现在str1匹配到 i 位置,子串str2匹配到 j 位置,则有:
如果当前字符匹配成功(即str1[i] == str2[j]),则i++,j++,继续匹配下一个字符
如果失配(即str1[i]! = str2[j]),令i = i - (j - 1),j = 0。相当于每次匹配失败时,i 回溯,j 被置为0。
用暴力方法解决的话就会有大量的回溯,每次只移动一位,若是不匹配,移动到下一位接着判断,浪费了大量的时间。(不可行!)
//暴力匹配算法实现.
public static int violenceMatch(String str1, String str2) {
// char[] toCharArray() 将此字符串转换为新的字符数组。
char[] s1 = str1.toCharArray();
char[] s2 = str2.toCharArray();
int s1len = s1.length;
int s2len = s2.length;
int i = 0;// i索引指向s1
int j = 0;// j索引指向s2
while (i < s1len && j < s2len) {
// (即str1[i] == str2[j]),则i++,j++,继续匹配下一个字符
if (s1[i] == s2[j]) {
i++;
j++;
} else {
// 令i = i - (j - 1),j = 0。
// 相当于每次匹配失败时,i 回溯,j 被置为0。
i = i - j +1;
j = 0;}}
if (j == s2len) {
return i - j;
} else {
return -1;
}}}}
kmp 算法
移动位数 = 已匹配的字符数 - 对应的部分匹配值(前缀 和后缀)
- 先得到字串的 部分匹配表
- 使用部分匹配表完成kmp 匹配
介绍《部分匹配表》怎么产生的 先介绍前缀,后缀是什么
“部分匹配值”就是”前缀”和”后缀”的最长的共有元素的长度。以”ABCDABD”为例,
-”A”的前缀和后缀都为空集,共有元素的长度为0;
-”AB”的前缀为[A],后缀为[B],共有元素的长度为0;
-”ABC”的前缀为[A, AB],后缀为[BC, C],共有元素的长度0;
-”ABCD”的前缀为[A, AB, ABC],后缀为[BCD, CD, D],共有元素的长度为0;
-”ABCDA”的前缀为[A, AB, ABC, ABCD],后缀为[BCDA, CDA, DA, A],共有元素为”A”,长度为1;
-”ABCDAB”的前缀为[A, AB, ABC, ABCD, ABCDA],后缀为[BCDAB, CDAB, DAB, AB, B],共有元素为”AB”,长度为2;
-”ABCDABD”的前缀为[A, AB, ABC, ABCD, ABCDA, ABCDAB],后缀为[BCDABD, CDABD, DABD, ABD, BD, D],共有元素的长度为0。
// 写出我们的kmp 算法
/**
*
* @param str1 源字符串
* @param str2 字串
* @param next 部分匹配表, 是子串对应的部分匹配表
* @return 如果是-1就是没有匹配到,否则返回第一个匹配的位置
*/
public static int kmpSearch(String str1, String str2, int[] next) {
// 遍历
for (int i = 0, j = 0; i < str1.length(); i++) {
// KMP算法核心点, 可以验证...
// 需要处理 str1.charAt(i) != str2.charAt(j), 去调整j的大小
while (j > 0 && str1.charAt(i) != str2.charAt(j)) {
j = next[j - 1];
}
// 需要处理 str1.charAt(i) == str2.charAt(j),
if (str1.charAt(i) == str2.charAt(j)) {
j++;
}
if (j == str2.length()) {
return i - j + 1;
}
}
return -1;
}
// 获取一个字符串(字串)的部分匹配值表
public static int[] kmpNext(String dest) {
// 创建一个next 数组保存部分匹配值
int[] next = new int[dest.length()];
next[0] = 0; // 如果字符串是长度为1 的部分匹配值就是0
for (int i = 1, j = 0; i < dest.length(); i++) {
// kmp 的核心点
// dest.charAt(i)!=dest.charAt(j) 我们需要从next[j-1]获取新的j
while (j > 0 && dest.charAt(i) != dest.charAt(j)) {
j = next[j - 1];
}
// dest.charAt(i)==dest.charAt(j) 满足时, 部分匹配值就 +1
if (dest.charAt(i) == dest.charAt(j)) {
j++;
}
next[i] = j;
}
return next;
}