字符串转拼音(包括汉语、英文和数字)

近期做的项目中需要实现将字符串转拼音,字符串中包含汉字、英文和数字。汉字转拼音(包括多音字)、英文和数字转拼音,这里将单词都作为单独的英文字母进行处理。

1、将英文字母发音对应的拼音存入数据库表phonetic,这里需要用到将excel表格数据导入数据库中。首先将26个英文字母按如下格式存入excel表格,然后再导入mysql数据库。首先在数据库中新建数据库表phonetic,数据库表中字段也和excel表格中的对应;导入方法详见:http://jingyan.baidu.com/article/fc07f9891cb56412ffe5199a.html


2、对应输入的字符串,先处理英文。先将英文大写转小写(数据库中存的是英文字母的小写,当然也可以存大写字母),小写则不变,并获得其对应的拼音。具体代码如下:

/*
	 * 英语大写字母转小写,并获得对于的拼音
	 */
	public static String TranToPinyin(char ch){
		Phonttic1Domain phonttic1Domain = new Phonttic1Domain();
		//String s = str.toLowerCase();
		String str="";
		if(Character.isUpperCase(ch)){
			str = Character.toLowerCase(ch)+"";
		}else{
			str = ch+"";
		}
		phonttic1Domain = CRUD.getCPhoneticByCharacter(str);
		String s = phonttic1Domain.getcPhonetic();
		return s;		
	}
	
	/*
	  * 将字符串中的英文分别转换成对应的拼音
	  */
	 public static String containEn(String str){
			String subStr="";
			String chins="";
			Pattern p = Pattern.compile("[A-Za-z]");
			Matcher m = p.matcher(str);
			
			if(m.find()){
				for(int i=0;i<str.length();i++){
					if((str.charAt(i)+"").matches("[A-Za-z]")){
						subStr=TranToPinyin(str.charAt(i));
						chins+=subStr;
					}else{
						chins+=str.charAt(i)+"";
					}
				}
			}
package oa.common.utils; import net.sourceforge.pinyin4j.PinyinHelper; import net.sourceforge.pinyin4j.format.HanyuPinyinCaseType; import net.sourceforge.pinyin4j.format.HanyuPinyinOutputFormat; import net.sourceforge.pinyin4j.format.HanyuPinyinToneType; import net.sourceforge.pinyin4j.format.HanyuPinyinVCharType; import net.sourceforge.pinyin4j.format.exception.BadHanyuPinyinOutputFormatCombination; /** * 文件名:PingYinUtil.java 拼音工具类 * 版本信息:V1.0 * 日期:2013-06-18 * Copyright BDVCD Corporation 2013 * 版权所有 http://www.bdvcd.com * */ public class PingYinUtil { /** * 将字符串中的中文化为拼音,其他字符不变 * * @param inputString * @return */ public static String getPingYin(String inputString) { HanyuPinyinOutputFormat format = new HanyuPinyinOutputFormat(); format.setCaseType(HanyuPinyinCaseType.LOWERCASE); format.setToneType(HanyuPinyinToneType.WITHOUT_TONE); format.setVCharType(HanyuPinyinVCharType.WITH_V); char[] input = inputString.trim().toCharArray(); String output = ""; try { for (int i = 0; i < input.length; i++) { if (java.lang.Character.toString(input[i]).matches("[\\u4E00-\\u9FA5]+")) { String[] temp = PinyinHelper.toHanyuPinyinStringArray(input[i], format); output += temp[0]; } else output += java.lang.Character.toString(input[i]); } } catch (BadHanyuPinyinOutputFormatCombination e) { e.printStackTrace(); } return output; } /** * 获取汉字串拼音首字母,英文字符不变 * @param chinese 汉字串 * @return 汉语拼音首字母 */ public static String getFirstSpell(String chinese) { StringBuffer pybf = new StringBuffer(); char[] arr = chinese.toCharArray(); HanyuPinyinOutputFormat defaultFormat = new HanyuPinyinOutputFormat(); defaultFormat.setCaseType(HanyuPinyinCaseType.LOWERCASE); defaultFormat.setToneType(HanyuPinyinToneType.WITHOUT_TONE); for (int i = 0; i 128) { try { String[] temp = PinyinHelper.toHanyuPinyinStringArray(arr[i], defaultFormat); if (temp != null) { pybf.append(temp[0].charAt(0)); } } catch (BadHanyuPinyinOutputFormatCombination e) { e.printStackTrace(); } } else { pybf.append(arr[i]); } } return pybf.toString().replaceAll("\\W", "").trim(); } /** * 获取汉字串拼音英文字符不变 * @param chinese 汉字串 * @return 汉语拼音 */ public static String getFullSpell(String chinese) { StringBuffer pybf = new StringBuffer(); char[] arr = chinese.toCharArray(); HanyuPinyinOutputFormat defaultFormat = new HanyuPinyinOutputFormat(); defaultFormat.setCaseType(HanyuPinyinCaseType.LOWERCASE); defaultFormat.setToneType(HanyuPinyinToneType.WITHOUT_TONE); for (int i = 0; i 128) { try { pybf.append(PinyinHelper.toHanyuPinyinStringArray(arr[i], defaultFormat)[0]); } catch (BadHanyuPinyinOutputFormatCombination e) { e.printStackTrace(); } } else { pybf.append(arr[i]); } } return pybf.toString(); } public static void main(String[] as){ System.out.println(getPingYin("非诚勿扰")); } }
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值