#去除特殊字符,只保留汉子,字母、数字
import re
s = ‘1123*#$ 中abc国’
str = re.sub(’[a-zA-Z0-9’!"#KaTeX parse error: Expected 'EOF', got '#' at position 61: …~\s]+', "", s) #̲[a-zA-Z0-9’!"#%&’()*+,-./:;<=>?@,。?★、…【】《》?“”‘’![\]^_`{|}~\s] 不含这些参数的字符
#去除不可见字符
str=re.sub(’[\001\002\003\004\005\006\007\x08\x09\x0a\x0b\x0c\x0d\x0e\x0f\x10\x11\x12\x13\x14\x15\x16\x17\x18\x19\x1a]+’, ‘’,str)
print(str)