Python实现全角与半角相互转换

最新推荐文章于 2024-06-20 17:44:19 发布

黄然大悟

最新推荐文章于 2024-06-20 17:44:19 发布

阅读量7.1k

点赞数 8

分类专栏： Python 文章标签：全角半角转换全角半角对照表全角半角编码 Python全角半角

本文链接：https://blog.csdn.net/huanghaocs/article/details/90384163

版权

全角与半角转换在处理汉语语料中会经常出现，这里分别说明汉字、数字、字母的unicode编码范围。以及全角与半角的转换方法。最后给出wiki上全角和半角的编码对照表。这里Python需要用Python3版本。

汉字的判断

汉字的unicode编码范围 u4e00 到 u9fa5。

def is_chinese(uchar):
    """判断一个unicode是否是汉字"""
    if uchar >= u'\u4e00' and uchar<=u'\u9fa5':
        return True
    else:
        return False

数字0-9的判断

数字的unicode编码范围根据全角和半角，有两个不同区域，半角数字 u0030 到 u0039，全角数字 uff10 到 uff19。

def is_number(uchar):
    """判断一个unicode是否是半角数字"""
    if uchar >= u'\u0030' and uchar<=u'\u0039':
        return True
    else:
        return False
    
def is_Qnumber(uchar):
    """判断一个unicode是否是全角数字"""
    if uchar >= u'\uff10' and uchar <= u'\uff19':
        return True
    else:
        return False

大小写字母判断

字母的unicode编码根据字母大小写，以及全角和半角共有四个区域。
半角大写字母：u0041 - u005a ，半角小写字母：u0061 - u007a ；
全角大写字母：uff21 - uff3a ，全角小写字母：uff41 - uff5a 。

def is_alphabet(uchar):
    """判断一个unicode是否是半角英文字母"""
    if (uchar >= u'\u0041' and uchar <= u'\u005a') or (uchar >= u'\u0061' and uchar <= u'\u007a'):
        return True
    else:
        return False

def is_Qalphabet(uchar):
    """判断一个unico

最低0.47元/天解锁文章

黄然大悟

关注

8
点赞
踩
42

收藏

觉得还不错? 一键收藏
1
评论
Python实现全角与半角相互转换

全角与半角转换在处理汉语语料中会经常出现，这里分别说明汉字、数字、字母的unicode编码范围。以及全角与半角的转换方法。最后给出wiki上全角和半角的编码对照表。汉字的判断汉字的unicode编码范围 u4e00 到 u9fa5。def is_chinese(uchar): """判断一个unicode是否是汉字""" if uchar >= u'\u4e00' an...
复制链接

扫一扫

专栏目录