Python从入门到精通,100天就够了!(6)——常用数据结构之字符串

上一章我们讲了元组(tuple),这一章我们讲讲字符串(str)。字符串类型是 Python 里面最常见的类型。知道如何表示和操作字符串对程序员来说是非常重要的,因为我们需要处理文本信息。 字符串就是把一个个文字字符“串起来”的数据,这里的文字字符包含有:拉丁字母、数字、标点符号、特殊符号以及各种语言文字字符。

一、字符串的创建

在Python程序中,如果我们把单个或多个字符用单引号或者双引号包围起来,就可以表示一个字符串。字符串中的字符可以是特殊符号、英文字母、中文字符、日文的平假名或片假名、希腊字母、Emoji字符等。
我们可以简单地通过在引号间包含字符的方式创建它。Python 里面单引号和双引号的作用是相同的。

s1 = 'hello, world!'
s2 = "你好,世界!"
print(s1, s2)
# 以三个双引号或单引号开头的字符串可以折行
s3 = '''
hello, 
world!
'''
print(s3, end='')

提示print函数中的end=''表示输出后不换行,即将默认的结束符\n(换行符)更换为''(空字符)。

二、转义字符和原始字符串

可以在字符串中使用\(反斜杠)来表示转义,也就是说\后面的字符不再是它原来的意义,例如:\n不是代表反斜杠和字符n,而是表示换行;\t也不是代表反斜杠和字符t,而是表示制表符。所以如果字符串本身又包含了'"\这些特殊的字符,必须要通过\进行转义处理。例如要输出一个带单引号或反斜杠的字符串,需要用如下所示的方法。

s1 = '\'hello, world!\''
print(s1)                  # 'hello, world!'
s2 = '\\hello, world!\\'
print(s2)                  # '\hello, world!\'

Python中的字符串可以rR开头,这种字符串被称为原始字符串,意思是字符串中的每个字符都是它本来的含义,没有所谓的转义字符。例如,在字符串'hello\n'中,\n表示换行;而在r'hello\n'中,\n不再表示换行,就是反斜杠和字符n。大家可以运行下面的代码,看看会输出什么。

# 字符串s1中\t是制表符,\n是换行符
s1 = '\time up \now'
print(s1)                 # 	ime up 
                          # ow
# 字符串s2中没有转义字符,每个字符都是原始含义
s2 = r'\time up \now'
print(s2)                 # \time up \now

具体的转义字符表示的功能请看下图:
请添加图片描述

Python中还允许在\后面还可以跟一个八进制或者十六进制数来表示字符,例如\141\x61都代表小写字母a,前者是八进制的表示法,后者是十六进制的表示法。另外一种表示字符的方式是在\u后面跟Unicode字符编码,例如\u4f60\u597d代表的是中文“你好”。运行下面的代码,看看输出了什么。

s1 = '\141\142\143\x61\x62\x63'   # abcabc
s2 = '\u4f60\u597d'               # 你好
print(s1, s2)
三、字符串的运算

Python为字符串类型提供了非常丰富的运算符,我们可以使用+运算符来实现字符串的拼接,可以使用*运算符来重复一个字符串的内容,可以使用innot in来判断一个字符串是否包含另外一个字符串,我们也可以用[][:]运算符从字符串取出某个字符或某些字符。

1. 拼接和重复

下面的例子演示了使用+*运算符来实现字符串的拼接和重复操作。

a = 'hello,' 
b = 'world'
c = 'Python '
print(c * 3)                     # Python Python Python
print(a + b)                     # hello, world

2. 比较运算

对于两个字符串类型的变量,可以直接使用比较运算符比较两个字符串的相等性或大小。需要说明的是,因为字符串在计算机内存中也是以二进制形式存在的,那么字符串的大小比较比的是每个字符对应的编码的大小。例如A的编码是65, 而a的编码是97,所以'A' < 'a'的结果相当于就是65 < 97的结果,很显然是True;而'boy' < 'bad',因为第一个字符都是'b'比不出大小,所以实际比较的是第二个字符的大小,显然'o' < 'a'的结果是False,所以'boy' < 'bad'的结果也是False。如果不清楚两个字符对应的编码到底是多少,可以使用ord函数来获得

s1 = 'a whole new world'
s2 = 'hello world'
print(s1 == s2, s1 < s2)      # False True
print(s2 == 'hello world')    # True
print(s2 == 'Hello world')    # False
print(s2 != 'Hello world')    # True
s3 = '你好'
print(ord('你'), ord('好'))               # 20320 22909
s4 = '我爱你'
print(ord('我'), ord('爱'), ord('你'))    # 25105 29233 20320
print(s3 > s4, s3 <= s4)      # False True
3. 成员运算

Python中可以用innot in判断一个字符串中是否存在另外一个字符或字符串,innot in运算通常称为成员运算,会产生布尔值TrueFalse,代码如下所示。

s1 = 'hello, world'
print('wo' in s1)    # True
s2 = 'goodbye'
print(s2 in s1)      # False
4. 获取字符串长度

获取字符串长度没有直接的运算符,而是使用内置函数len,代码如下所示。

s = 'hello, world'
print(len(s))                   # 12
print(len('goodbye, world'))    # 14
5. 字符串索引与切片

如果希望从字符串中取出某个字符,我们可以对字符串进行索引运算,运算符是[n]。其中n是一个整数,假设字符串的长度为N,那么n可以是从0N-1的整数。注意,因为字符串是不可变类型,所以不能通过索引运算修改字符串中的字符

s = 'abc123456'
N = len(s)

# 获取第一个字符
print(s[0], s[-N])    # a a

# 获取最后一个字符
print(s[N-1], s[-1])  # 6 6

# 获取索引为2或-7的字符
print(s[2], s[-7])    # c c

如果要从字符串中取出多个字符,我们可以对字符串进行切片,运算符是[i:j:k],其中i是开始索引,索引对应的字符可以取到;j是结束索引,索引对应的字符不能取到;k是步长,默认值为1,表示从前向后获取相邻字符的连续切片,所以:k部分可以省略。

s = 'abc123456'

# i=2, j=5, k=1的正向切片操作
print(s[2:5])       # c12

# i=2, j=9, k=1的正向切片操作
print(s[2:])        # c123456

# i=2, j=9, k=2的正向切片操作
print(s[2::2])      # c246

# i=0, j=9, k=2的正向切片操作
print(s[::2])       # ac246

# i=7, j=1, k=-1的负向切片操作
print(s[7:1:-1])    # 54321c

# i=0, j=9, k=2的正向切片
print(s[::2])       # ac246

# i=-1, j=-10, k=-1的负向切片
print(s[::-1])      # 654321cba
6. 循环遍历每个字符

如果希望从字符串中取出每个字符,可以使用for循环对字符串进行遍历,有两种方式。
方式一:

s1 = 'hello'
for index in range(len(s1)):
    print(s1[index])

方式二:

s1 = 'hello'
for ch in s1:
    print(ch)
四、字符串的方法
1. 大小写相关操作

下面的代码演示了和字符串大小写变换相关的方法。

a = 'i LOVE you'
# 使用upper方法获得字符串大写后的字符串
print(a.upper())                # I LOVE YOU
# 使用lower方法获得字符串小写后的字符串
print(a.lower())                # i love you
# 使用capitalize方法获得字符串首字母大写后的字符串
print(a.capitalize())           # I love you
# 使用title方法获得字符串每个单词首字母大写后的字符串
print(a.title())                # I Love You
2. 查找操作

如果想在一个字符串中从前向后查找有没有另外一个字符串,可以使用字符串的findindex方法。

s = 'hello, world!'

# find方法从字符串中查找另一个字符串所在的位置
# 找到了返回字符串中另一个字符串首字符的索引
print(s.find('or'))        # 8
# 找不到返回-1
print(s.find('shit'))      # -1
# index方法与find方法类似
# 找到了返回字符串中另一个字符串首字符的索引
print(s.index('or'))       # 8
# 找不到引发异常
print(s.index('shit'))     # ValueError: substring not found

在使用findindex方法时还可以通过方法的参数来指定查找的范围,也就是查找不必从索引为0的位置开始。findindex方法还有逆向查找(从后向前查找)的版本,分别是rfindrindex,代码如下所示。

s = 'hello good world!'

# 从前向后查找字符o出现的位置(相当于第一次出现)
print(s.find('o'))       # 4
# 从索引为5的位置开始查找字符o出现的位置
print(s.find('o', 5))    # 7
# 从后向前查找字符o出现的位置(相当于最后一次出现)
print(s.rfind('o'))      # 12
3. 性质判断

可以通过字符串的startswithendswith来判断字符串是否以某个字符串开头和结尾;还可以用is开头的方法判断字符串的特征,这些方法都返回布尔值,代码如下所示。

s1 = 'hello, world!'

# startwith方法检查字符串是否以指定的字符串开头返回布尔值
print(s1.startswith('He'))    # False
# endswith方法检查字符串是否以指定的字符串结尾返回布尔值
print(s1.endswith('!'))       # True

s2 = 'abc123456'

# isdigit方法检查字符串是否由数字构成返回布尔值
print(s2.isdigit())    # False
# isalpha方法检查字符串是否以字母构成返回布尔值
print(s2.isalpha())    # False
# isalnum方法检查字符串是否以数字和字母构成返回布尔值
print(s2.isalnum())    # True
4. 格式化字符串

在Python中,字符串类型可以通过centerljustrjust方法做居中、左对齐和右对齐的处理。

s = 'hello, world'

# center方法以宽度20将字符串居中并在两侧填充*
print(s.center(20, '*'))  # ****hello, world****
# rjust方法以宽度20将字符串右对齐并在左侧填充空格
print(s.rjust(20))        #         hello, world
# ljust方法以宽度20将字符串左对齐并在右侧填充~
print(s.ljust(20, '~'))   # hello, world~~~~~~~~

我们之前讲过,在用print函数输出字符串时,可以用下面的方式对字符串进行格式化。

a = 321
b = 123
print('%d * %d = %d' % (a, b, a * b))

当然,我们也可以用字符串的方法来完成字符串的格式,代码如下所示。

a = 321
b = 123
print('{0} * {1} = {2}'.format(a, b, a * b))

从Python 3.6开始,格式化字符串还有更为简洁的书写方式,就是在字符串前加上f来格式化字符串,在这种以f打头的字符串中,{变量名}是一个占位符,会被变量对应的值将其替换掉,代码如下所示。

a = 321
b = 123
print(f'{a} * {b} = {a * b}')

如果需要进一步控制格式化语法中变量值的形式,可以参照下面的表格来进行字符串格式化操作。

变量值占位符格式化结果说明
3.1415926{:.2f}'3.14'保留小数点后两位
3.1415926{:+.2f}'+3.14'带符号保留小数点后两位
-1{:+.2f}'-1.00'带符号保留小数点后两位
3.1415926{:.0f}'3'不带小数
123{:0>10d}'0000000123'左边补0,补够10位
123{:x<10d}'123xxxxxxx'右边补x ,补够10位
123{:>10d}' 123'左边补空格,补够10位
123{:<10d}'123 '右边补空格,补够10位
123456789{:,}'123,456,789'逗号分隔格式
0.123{:.2%}'12.30%'百分比格式
123456789{:.2e}'1.23e+08'科学计数法格式
5. 字符串拆分与合并

split方法默认以空格拆分字符串。join方法将列表中的字符元素合并为一个大的字符串

# 以空格拆分字符串得到一个列表
words = 'You go your way I will go mine.'
list1 = words.split()
for word in list1:
    print(word)
# You
# go
# your
# way
# I
# will
# go
# mine.

# 以句号合并两个字符串得到一个列表
words1 = '我爱你'
words2 =','.join(words1)
print(words2)        # 我,爱,你
6. 字符串的修剪操作

字符串的strip方法可以帮我们获得将原字符串修剪掉左右两端空格之后的字符串。strip方法还有lstriprstrip两个版本,相信从名字大家已经猜出来这两个方法是做什么用的。在Python中,字符串类型可以通过replace方法将前一个''中的字符转换成后一个''中的内容。

words = 'You go your way, I will go mine.'
words2 = words.replace(',', ' ')
print(words2)            # You go your way  I will go mine.

email = ' 1169455362@qq.com '
tel = ' 110 '
# 去掉左右两边空格
print(email.strip())     # 1169455362@qq.com
# 去掉左边空格    
print(tel.lstrip())      # 110 
# 去掉右边空格
print(email.rstrip())    #  1169455362@qq.com

以上就是字符串的基本操作,内容又多又杂,还需要大家多多练习呢。Get It!
请添加图片描述

  • 11
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 2
    评论
评论 2
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值