面向对象的程序设计:把计算机程序视为一组对象的集合,而每个对象都可以接收其他对象发过来的消息,并处理这些消息,计算机程序的执行就是一系列消息在各个对象之间传递。
面向过程的程序设计:把计算机程序视为一系列的命令集合,即一组函数的顺序执行。为了简化程序设计,面向过程把函数继续切分为子函数,即把大块函数通过切割成小块函数来降低系统的复杂度。
在Python中,所有数据类型都可以视为对象,当然也可以自定义对象。自定义的对象数据类型就是面向对象中的类(Class)的概念。
面向过程和面向对象的不同:
面向过程:
std1 = {'name':'diaochan','score':90}
std2 = {'name':'xiaoqiao','score':96}
def print_score(std):
print('%s :%s'% (std['name'],std['score']))
print_score(std1)
print_score(std2)
diaochan :90
xiaoqiao :96
如果采用面向对象的程序设计思想,我们首选思考的不是程序的执行流程,而是Student
这种数据类型应该被视为一个对象,这个对象拥有name
和score
这两个属性(Property)。如果要打印一个学生的成绩,首先必须创建出这个学生对应的对象,然后,给对象发一个print_score
消息,让对象自己把自己的数据打印出来。
给对象发消息实际上就是调用对象对应的关联函数,我们称之为对象的方法(Method)。
class Student(object):
def __init__(self,name,score):
self.name = name
self.score = score
def print_score(self):
print('%s :%s' % (self.name, self.score))
s1 = Student('diaochan',90)
s1.print_score() #不能写成print_score(s1)
diaochan :90
面向对象的设计思想是抽象出Class,根据Class创建Instance。
面向对象的抽象程度又比函数要高,因为一个Class既包含数据,又包含操作数据的方法。
数据封装、继承和多态是面向对象的三大特点。
类是抽象的模板,比如Student类,而实例是根据类创建出来的一个个具体的“对象”,每个对象都拥有相同的方法,但各自的数据可能不同。
好记:
上帝
class 类 (人) instance 实例 (你,我,他) 你会有些属性(身高,年龄,体重) 你会有些技能(吃饭,学习)
_init_ 方法的主要作用,就是初始化你的属性,这些属性,在上帝初始化你的时候就要赋予给你,比如s1 = Person(170,29,50)这时上帝就把你创造出来了,也就是实例化了你,然后,你到底有哪些技能呢,这就看有没有在类里面定义了,如果有吃饭的技能,那么你就可以调用吃饭的技能。
类和实例
面向对象最重要的概念就是类(Class)和实例(Instance)。
Student
类为例:
(1)定义类是通过class
关键字
class
后面紧接着是类名,即Student,类名通常是大写开头的单词,紧接着是(object),表示该类是从哪个类继承下来的,继承的概念我们后面再讲,通常,如果没有合适的继承类,就使用object类,这是所有类最终都会继承的类。
(2)根据Student
类创建出Student
的实例,创建实例是通过类名+()实现的
class Student(object):
pass
b = Student()
print(b)
print(Student)
<__main__.Student object at 0x000002242B6BBFD0>
<class '__main__.Student'>
变量b
指向的就是一个Student
的实例,后面的0x000002242B6BBFD0
是内存地址,每个object的地址都不一样,而Student
本身则是一个类。
可以自由地给一个实例变量绑定属性,比如,给实例b
绑定一个name
属性:
b.name = 'jie'
print(b.name)
jie
(3)由于类可以起到模板的作用,因此,可以在创建实例的时候,把一些我们认为必须绑定的属性强制填写进去。通过定义一个特殊的__init__
方法,在创建实例的时候,就把name
,score
等属性绑上去。
注意:特殊方法__init__
前后分别有两个下划线!!!
__init__
方法的第一个参数永远是self,表示创建的实例本身,因此,在__init__
方法内部,就可以把各种属性绑定到self,因为self就指向创建的实例本身。
有了__init__
方法,在创建实例的时候,就不能传入空的参数了,必须传入与__init__
方法匹配的参数,但self
不需要传,Python解释器自己会把实例变量传进去:
s1 = Student('diaochan',90)
print(s1.name)
diaochan
和普通的函数相比,在类中定义的函数只有一点不同,就是第一个参数永远是实例变量self,并且,调用时,不用传递该参数。除此之外,类的方法和普通函数没有什么区别。
数据封装
面向对象编程的一个重要特点就是数据封装。
如Student
类中,每个实例就拥有各自的name
和score
这些数据。可以通过函数来访问这些数据。但是,Student
实例本身就拥有这些数据,可以直接在Student
类的内部定义访问数据的函数,这样,就把“数据”给封装起来了。这些封装数据的函数是和Student
类本身是关联起来的,我们称之为类的方法:
#外部函数访问数据(name,score)
class Student(object):
def __init__(self,name,score):
self.name = name
self.score = score
def print_score(s1):
print('%s :%s' % (s1.name, s1.score))
s1 = Student('diaochan',90)
print_score(s1)
diaochan :90
#内部函数访问,即封装
class Student(object):
def __init__(self,name,score):
self.name = name
self.score = score
def print_score(s1):
print('%s :%s' % (s1.name, s1.score))
s1 = Student('diaochan',90)
s1.print_score()
diaochan :90
第七行第八行要定义一个方法,除了第一个参数是self
外,其他和普通函数一样。要调用一个方法,只需要在实例变量上直接调用,除了self不用传递,其他参数正常传入。
这样从外部看Student
类,只需要知道创建实例需要给出name
和score
,打印是在Student
类的内部定义的,这些数据和逻辑被“封装”起来了,调用很容易,但却不用知道内部实现的细节。
#封装另一好处:增加新的方法
def get_grade(self):
if self.score >= 90:
return 'A'
if self.score >= 60:
return 'B'
else:
return 'C'
访问限制
从前面的例子可以看出,外部代码还是可以自由地修改一个实例的name
、score
属性:
>>> bart = Student('Bart Simpson', 59)
>>> bart.score
59
>>> bart.score = 99
>>> bart.score
99
在Python中,如果要让内部属性不被外部访问,可以把属性的名称前加上两个下划线__
,就变成了一个私有变量(private),只有内部可以访问,外部不能访问,所以,把Student
类改一改:
#无法从外部访问实例变量.__name和实例变量.__score
class Student(object):
def __init__(self,name,score):
self.__name = name
self.__score = score
def print_score(s1):
print('%s :%s' % (s1.name, s1.score))
s1 = Student('diaochan',90)
s1.__name()
Traceback (most recent call last):
File "D:/python exercise/exercise.py", line 233, in <module>
s1.__name()
AttributeError: 'Student' object has no attribute '__name'
如果外部代码要获取name
和score
,或者修改score
,或者在方法中对参数做检查,可以改为:
#外部代码要获取name和score,增加get_name和get_score这样的方法
def get__name(self):
return self.__name
def get__score(self):
return self.__score
#外部代码要修改score,给Student类增加set_score方法/对参数做检查
def set__score(self):
if 0 <= score <= 100:
self.__score = score
else:
raise ValueError('bad score')
注意:
xxx:以双下划线开头,以双下划线结尾,是特殊变量,特殊变量是可以直接访问的,不是private变量,所以,不能用__name__、__score__这样的变量名。
_name:一个下划线开头,这样的实例变量外部是可以访问的,但是,当你看到这样的变量时,意思就是,“虽然我可以被访问,但是,请把我视为私有变量,不要随意访问”。
__name:双下划线开头,不是不能从外部访问,不能直接访问是因为Python解释器对外把__name变量改成了_Student__name,所以,仍然可以通过_Student__name来访问__name变量,但是强烈建议不这么做,因为不同版本的Python解释器可能会把__name改成不同的变量名。
#错误写法
s1 = Student('diaochan',90)
print(s1.get__name())
s1.__name = 'xiaoqiao'
print(s1.__name)
print(s1.get__name())
diaochan
xiaoqiao
diaochan
可以看出,外部代码虽然设置了__name
变量,但实际上这个__name
变量和class内部的__name
变量不是一个变量!内部的__name
变量已经被Python解释器自动改成了_Student__name
,而外部代码给s1
新增了一个__name
变量。
练习
把Student
对象的gender
字段对外隐藏起来,用get_gender()
和set_gender()
代替,并检查参数有效性:
class Student(object):
def __init__(self, name, gender):
self.name = name
self.__gender = gender
def get_gender(self):
return self.__gender
def set_gender(self,gender): #或者:
if gender == 'male':
self.__gender = gender
if gender == 'female':
self.__gender = gender
# if gender in ('male', 'female'):
# self.__gender = gender
else:
raise ValueError('Please input true gender')
# 测试:
bart = Student('Bart', 'male')
if bart.get_gender() != 'male':
print('测试失败!')
else:
bart.set_gender('female')
if bart.get_gender() != 'female':
print('测试失败!')
else:
print('测试成功!')
测试成功!
继承和多态
继承
当我们定义一个class的时候,可以从某个现有的class继承,新的class称为子类(Subclass),而被继承的class称为基类、父类或超类(Base class、Super class)。
例如:
#继承
class Animal(object): #被继承,父类
def run(self): #定义一个run方法
print('Animal is running ……')
class Dog(Animal): #继承,即子类
def run(self): #子类也可增加一些方法
print('Dog is running ……')
def eat(self):
print('Eating meat ……')
class Cat(Animal): #继承,即子类
print('Cat is running ……')
dog = Dog()
dog.run()
dog.eat()
print('******************')
cat = Dog()
cat.run()
Cat is running ……
Dog is running ……
Eating meat ……
******************
Dog is running ……
继承好处:
(1)子类获得了父类的全部功能。由于Animial实现了run()
方法,因此,Dog
和Cat
作为它的子类,什么事也没干,就自动拥有了run()
方法。
(2)需要对代码做一点改进。如果子类不定义run()
,无论是Dog
还是Cat
,它们run()
的时候,显示的都是Animal is running...
,改过之后可以显示Dog is running...
和Cat is running...
。
当子类和父类都存在相同的run()
方法时,子类的run()
覆盖了父类的run()
,在代码运行的时候,总是会调用子类的run()
。这样就获得了继承的另一个好处:多态。
多态
当定义一个class的时候,我们实际上就定义了一种数据类型:
a = list() # a是list类型
b = Animal() # b是Animal类型
c = Dog() # c是Dog类型
a = list() # a是list类型
print(isinstance(a,list)) #用isinstance()判断变量的类型
True
以上面为例:
c = Dog()
print(isinstance(c,Animal))
print(isinstance(c,Dog))
True
True
所以,在继承关系中,如果一个实例的数据类型是某个子类,那它的数据类型也可以被看做是父类。但是,反过来就不行。
更好的理解多态,看以下例子:
def run_twice(animal):
animal.run()
animal.run()
class Tortoise(Animal):
def run(self):
print('Tortoise is running slowly...')
run_twice(Animal())
run_twice(Dog())
run_twice(Tortoise())
Animal is running ……
Animal is running ……
Dog is running ……
Dog is running ……
Tortoise is running slowly...
Tortoise is running slowly...
新增一个Animal
的子类,不必对run_twice()
做任何修改,实际上,任何依赖Animal
作为参数的函数或者方法都可以不加修改地正常运行,原因就在于多态。
多态好处
当传入Dog
、Cat
……时,只需要接收Animal
类型就可以了,因为Dog
、Cat
……都是Animal
类型,然后,按照Animal
类型进行操作即可。由于Animal
类型有run()
方法,因此,传入的任意类型,只要是Animal
类或者子类,就会自动调用实际类型的run()
方法,这就是多态的意思。
对于一个变量,我们只需要知道它是Animal
类型,无需确切地知道它的子类型,就可以放心地调用run()
方法,而具体调用的run()
方法是作用在Animal
、Dog
、Cat
还是Tortoise
对象上,由运行时该对象的确切类型决定,这就是多态真正的威力:调用方只管调用,不管细节,而当我们新增一种Animal
的子类时,只要确保run()
方法编写正确,不用管原来的代码是如何调用的。这就是著名的“开闭”原则:
对扩展开放:允许新增Animal
子类;
对修改封闭:不需要修改依赖Animal
类型的run_twice()
等函数。
继承还可以一级一级地继承下来,就好比从爷爷->爸爸->儿子。任何类最终都可以追溯到根类object,比如:
静态语言 vs 动态语言
静态语言(例如Java):如果需要传入Animal
类型,则传入的对象必须是Animal
类型或者它的子类,否则,将无法调用run()
方法。
动态语言(例如Python):不一定需要传入Animal
类型。只需要保证传入的对象有一个run()
方法就可以。
class Timer(object):
def run(self):
print('Start...')
这就是动态语言的“鸭子类型”,它并不要求严格的继承体系,一个对象只要“看起来像鸭子,走起路来像鸭子”,那它就可以被看做是鸭子。
动态语言的鸭子类型特点决定了继承不像静态语言那样是必须的。
Python的“file-like object“就是一种鸭子类型。对真正的文件对象,它有一个read()
方法,返回其内容。但是,许多对象,只要有read()
方法,都被视为“file-like object“。许多函数接收的参数就是“file-like object“,你不一定要传入真正的文件对象,完全可以传入任何实现了read()
方法的对象。
为了更好的理解,把别人的举例放在了这里:
class Animal(object): #编写Animal类
def run(self):
print("Animal is running...")
class Dog(Animal): #Dog类继承Amimal类,没有run方法
pass
class Cat(Animal): #Cat类继承Animal类,有自己的run方法
def run(self):
print('Cat is running...')
pass
class Car(object): #Car类不继承,有自己的run方法
def run(self):
print('Car is running...')
class Stone(object): #Stone类不继承,也没有run方法
pass
def run_twice(animal):
animal.run()
animal.run()
run_twice(Animal())
run_twice(Dog())
run_twice(Cat())
run_twice(Car())
run_twice(Stone())
Animal is running...
Animal is running...
Animal is running...
Animal is running...
Cat is running...
Cat is running...
Car is running...
Car is running...
AttributeError: 'Stone' object has no attribute 'run'
有意思的是,大神解释这个代码为:除石头吃了不会跑的亏外,其余的都能run,都是“鸭子”。(佩服呀,简单易懂)
获取对象信息
使用type()
判断对象类型,使用type()
函数:
#基本类型
print(type(123))
<class 'int'>
#一个变量指向函数或者类
print(type(abs))
<class 'builtin_function_or_method'>
type()
函数返回的是什么类型呢?它返回对应的Class类型。如果要在if
语句中判断,就需要比较两个变量的type类型是否相同:
print(type(234) == type(456))
print(type(234) == int)
print(type(234) == type('456'))
True
True
False
判断基本数据类型可以直接写int
,str
等,但如果要判断一个对象是否是函数,可以使用types
模块中定义的常量:
import types
def fn():
pass
print(type(fn) == types.FunctionType)
print(type(abs) == types.BuiltinFunctionType)
print(type(lambda x: x) == types.LambdaType)
print( type((x for x in range(10)))==types.GeneratorType)
True
True
True
True
使用isinstance()
对于class的继承关系来说,使用type()
就很不方便。要判断class的类型,可以使用isinstance()
函数。
#继承关系:object -> Animal -> Dog -> Husky
a = Animal() #创建3种类型的对象
d = Dog()
h = Hushy()
print(isinstance(h,Hushy))
print(isinstance(h,Dog))
print(isinstance(h,Animal))
True
True
True
isinstance()
判断的是一个对象是否是该类型本身,或者位于该类型的父继承链上。
能用type()
判断的基本类型也可以用isinstance()判断:
print(isinstance('a',str))
print(isinstance(b'a',bytes))
True
True
还可以判断一个变量是否是某些类型中的一种:
#判断是否是list或者tuple
print(isinstance([1, 2, 3], (list, tuple)))
print(isinstance((1, 2, 3), (list, tuple)))
print(isinstance([1, 2, 3], (tuple)))
print(isinstance((1, 2, 3), (tuple)))
True
True
False
True
总是优先使用isinstance()判断类型,可以将指定类型及其子类“一网打尽”。
使用dir()
如果要获得一个对象的所有属性和方法,可以使用dir()
函数,它返回一个包含字符串的list,比如:
#获得一个str对象的所有属性和方法
print(dir('ABC'))
['__add__', '__class__', '__contains__', '__delattr__', '__dir__', '__doc__', '__eq__', '__format__', '__ge__', '__getattribute__', '__getitem__', '__getnewargs__', '__gt__', '__hash__', '__init__', '__init_subclass__', '__iter__', '__le__', '__len__', '__lt__', '__mod__', '__mul__', '__ne__', '__new__', '__reduce__', '__reduce_ex__', '__repr__', '__rmod__', '__rmul__', '__setattr__', '__sizeof__', '__str__', '__subclasshook__', 'capitalize', 'casefold', 'center', 'count', 'encode', 'endswith', 'expandtabs', 'find', 'format', 'format_map', 'index', 'isalnum', 'isalpha', 'isdecimal', 'isdigit', 'isidentifier', 'islower', 'isnumeric', 'isprintable', 'isspace', 'istitle', 'isupper', 'join', 'ljust', 'lower', 'lstrip', 'maketrans', 'partition', 'replace', 'rfind', 'rindex', 'rjust', 'rpartition', 'rsplit', 'rstrip', 'split', 'splitlines', 'startswith', 'strip', 'swapcase', 'title', 'translate', 'upper', 'zfill']
类似__xxx__
的属性和方法在Python中都是有特殊用途的,比如__len__
方法返回长度。在Python中,如果你调用len()
函数试图获取一个对象的长度,实际上,在len()
函数内部,它自动去调用该对象的__len__()
方法:
#下面两句代码是等价的
print(len('ABC'))
print('ABC'.__len__())
3
3
自己写的类,如果也想用len(myObj)的话,就自己写一个__len__()方法
class MyDog(object):
def __len__(self):
return 100
dog = MyDog()
print(len(dog))
100
大写换小写,例如:'ABC'.lower()
直接操作一个对象的状态:
class MyObject(object):
def __init__(self):
self.x = 9
def power(self):
return self.x * self.x
obj = MyObject()
#测试对象的属性
print(hasattr(obj,'x')) # 有属性'x'吗?
print(obj.x)
print(setattr(obj,'y',19)) # 设置一个属性'y'
print(hasattr(obj,'y')) # 有属性'y'吗?
print(getattr(obj,'y')) # 获取属性'y'
print(obj.y) # 获取属性'y'
print(getattr(obj,'z')) #试图获取不存在的属性,会抛出AttributeError的错误
print(getattr(obj,'z',404)) #传入一个default参数,如果属性不存在,就返回默认值
True
9
None
True
19
19
Traceback (most recent call last):
File "D:/python exercise/exercise.py", line 372, in <module>
print(getattr(obj,'z')) #试图获取不存在的属性,会抛出AttributeError的错误
AttributeError: 'MyObject' object has no attribute 'z'
404
获得对象的方法:
print(hasattr(obj,'power')) # 有属性'power'吗?
print(getattr(obj,'power')) # 获取属性'power'
fn = getattr(obj,'power') # 获取属性'power'并赋值到变量fn
print(fn) # fn指向obj.power
print(fn()) # 调用fn()与调用obj.power()是一样的
True
<bound method MyObject.power of <__main__.MyObject object at 0x0000016EE67B71D0>>
<bound method MyObject.power of <__main__.MyObject object at 0x0000016EE67B71D0>>
81
注意:
只有在不知道对象信息的时候,我们才会去获取对象信息。如果可以直接写:sum = obj.x + obj.y
,就不要写sum = getattr(obj, 'x') + getattr(obj, 'y')
def readImage(fp):
if hasattr(fp, 'read'):
return readData(fp)
return None
假设希望从文件流fp中读取图像,首先要判断该fp对象是否存在read方法,如果存在,则该对象是一个流,如果不存在,则无法读取。hasattr()
就派上了用场。
请注意,在Python这类动态语言中,根据鸭子类型,有read()
方法,不代表该fp对象就是一个文件流,它也可能是网络流,也可能是内存中的一个字节流,但只要read()
方法返回的是有效的图像数据,就不影响读取图像的功能。
实例属性和类属性
由于Python是动态语言,根据类创建的实例可以任意绑定属性。
给实例绑定属性的方法是通过实例变量,或者通过self
变量:
class Student(object):
def __init__(self,name):
self.name = name
s = Student('diaochan')
s.score = 90
如果Student
类本身需要绑定一个属性呢?可以直接在class中定义属性,这种属性是类属性,归Student
类所有:
class Student(object):
name = 'Student'
定义了一个类属性后,这个属性虽然归类所有,但类的所有实例都可以访问到:
class Student(object):
name = 'Student'
s = Student() # 创建实例s
print(s.name) # 打印name属性,因为实例并没有name属性,所以会继续查找class的name属性
print(Student.name) # 打印类的name属性
s.name = 'xiaoqiao' # 给实例绑定name属性
print(s.name) # 由于实例属性优先级比类属性高,因此,它会屏蔽掉类的name属性
print(Student.name) # 但是类属性并未消失,用Student.name仍然可以访问
del s.name # 如果删除实例的name属性
print(s.name) # 再次调用s.name,由于实例的name属性没有找到,类的name属性就显示出来了
Student
Student
xiaoqiao
Student
Student
从上面的例子可以看出,在编写程序的时候,千万不要对实例属性和类属性使用相同的名字,因为相同名称的实例属性将屏蔽掉类属性,但是当你删除实例属性后,再使用相同的名称,访问到的将是类属性。
练习
为了统计学生人数,可以给Student类增加一个类属性,每创建一个实例,该属性自动增加:
class Student(object):
count = 0
def __init__(self, name):
self.name = name
Student.count += 1
# 测试:
if Student.count != 0:
print('测试失败!')
else:
bart = Student('Bart')
if Student.count != 1:
print('测试失败!')
else:
lisa = Student('Bart')
if Student.count != 2:
print('测试失败!')
else:
print('Students:', Student.count)
print('测试通过!')
Students: 2
测试通过!