BF VS KMP 算法分析

暴力匹配算法 BF

如果用暴力匹配的思路,并假设现在str1匹配到 i 位置,子串str2匹配到 j 位置,则有:
如果当前字符匹配成功(即str1[i] == str2[j]),则i++,j++,继续匹配下一个字符
如果失配(即str1[i]! = str2[j]),令i = i - (j - 1),j = 0。相当于每次匹配失败时,i 回溯,j 被置为0。
用暴力方法解决的话就会有大量的回溯,每次只移动一位,若是不匹配,移动到下一位接着判断,浪费了大量的时间。(不可行!)
//暴力匹配算法实现.
public static int violenceMatch(String str1, String str2) {

	// char[] toCharArray() 将此字符串转换为新的字符数组。
	char[] s1 = str1.toCharArray();
	char[] s2 = str2.toCharArray();
	int s1len = s1.length;
	int s2len = s2.length;
	int i = 0;// i索引指向s1
	int j = 0;// j索引指向s2

	while (i < s1len && j < s2len) {
		// (即str1[i] == str2[j]),则i++,j++,继续匹配下一个字符
		if (s1[i] == s2[j]) {
			i++;
			j++; 
		} else {
			// 令i = i - (j - 1),j = 0。
			// 相当于每次匹配失败时,i 回溯,j 被置为0。

			i = i - j +1;
			j = 0;}}
	if (j == s2len) {
		return i - j;

	} else {
		return -1;
	}}}}

kmp 算法


移动位数 = 已匹配的字符数 - 对应的部分匹配值(前缀 和后缀)

  1. 先得到字串的 部分匹配表
  2. 使用部分匹配表完成kmp 匹配

介绍《部分匹配表》怎么产生的 先介绍前缀,后缀是什么

“部分匹配值”就是”前缀”和”后缀”的最长的共有元素的长度。以”ABCDABD”为例,
-”A”的前缀和后缀都为空集,共有元素的长度为0;
-”AB”的前缀为[A],后缀为[B],共有元素的长度为0;
-”ABC”的前缀为[A, AB],后缀为[BC, C],共有元素的长度0;
-”ABCD”的前缀为[A, AB, ABC],后缀为[BCD, CD, D],共有元素的长度为0;
-”ABCDA”的前缀为[A, AB, ABC, ABCD],后缀为[BCDA, CDA, DA, A],共有元素为”A”,长度为1;
-”ABCDAB”的前缀为[A, AB, ABC, ABCD, ABCDA],后缀为[BCDAB, CDAB, DAB, AB, B],共有元素为”AB”,长度为2;
-”ABCDABD”的前缀为[A, AB, ABC, ABCD, ABCDA, ABCDAB],后缀为[BCDABD, CDABD, DABD, ABD, BD, D],共有元素的长度为0。

// 写出我们的kmp 算法
/**
*
* @param str1 源字符串
* @param str2 字串
* @param next 部分匹配表, 是子串对应的部分匹配表
* @return 如果是-1就是没有匹配到,否则返回第一个匹配的位置
*/
public static int kmpSearch(String str1, String str2, int[] next) {
// 遍历
for (int i = 0, j = 0; i < str1.length(); i++) {

	     // KMP算法核心点, 可以验证...

		// 需要处理 str1.charAt(i) != str2.charAt(j), 去调整j的大小
		while (j > 0 && str1.charAt(i) != str2.charAt(j)) {
			j = next[j - 1];
		}

 // 需要处理 str1.charAt(i) == str2.charAt(j), 
 
		if (str1.charAt(i) == str2.charAt(j)) {
			j++;

		}
		if (j == str2.length()) {
			return i - j + 1;
		}



	}
	return -1;

}

// 获取一个字符串(字串)的部分匹配值表
public static int[] kmpNext(String dest) {
	// 创建一个next 数组保存部分匹配值
	int[] next = new int[dest.length()];
	
	next[0] = 0; // 如果字符串是长度为1 的部分匹配值就是0
	for (int i = 1, j = 0; i < dest.length(); i++) {
	
		// kmp 的核心点


		// dest.charAt(i)!=dest.charAt(j) 我们需要从next[j-1]获取新的j
	    while (j > 0 && dest.charAt(i) != dest.charAt(j)) {
			j = next[j - 1];

		}

		
		// dest.charAt(i)==dest.charAt(j) 满足时, 部分匹配值就 +1
		if (dest.charAt(i) == dest.charAt(j)) {
			j++;

		}
		next[i] = j;

	}
	return next;
}
  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值