Descriptor是什么?简而言之,Descriptor是用来定制访问类或实例的成员的一种协议。额。。好吧,一句话是说不清楚的。下面先介绍一下Python中成员变量的定义和使用。
我们知道,在Python中定义类成员和C/C++相比得到的结果具有很大的差别。如下面的定义:
class Cclass
{
int I;
void func();
};
Cclass c;
在上面的定义中,C++定义了一个类型,所有该类型的对象都包含有一个成员整数i和函数func;而Python则创建了一个名为Pclass、类型(class)为type(详情请参见MetaClass,Python中一切皆为对象,类型也不例外)的对象,然后再创建一个名为p、类型为Pclass的对象。如下所示:
In [71]: type(pclass)
Out[71]: <type 'type'>
In [72]: p = pclass()
In [73]: type(p)
Out[73]: <class '__main__.pclass'>
p和Pclass各自包含了一些成员,如下所示:
1 p.class p.init p.sizeof
2 p.delattr p.module p.str
3 p.dict p.new p.subclasshook
4 p.doc p.reduce p.weakref
5 p.format p.__reduce_ex p.f
6 p.getattribute p.repr p.i
7 p.hash p.setattr__
其中,带有双下划线的成员为特殊成员,或者可以称之为固定成员(和slots定义的成员类似),这些成员变量的值可以被改变,但不能被删除(del)。其中,class变量为对象所属的类型,doc为对象的文档字符串。有一个特殊成员值得注意:dict,该字典中保存了对象的自定义变量。相信大家在初学Python对于其中对象可以任意增加删除成员变量的能力感到惊讶,其实这个功能的玄机就在于dict成员中(注意type的dict为dictproxy类型):
In [10]: p.x = 2
In [11]: p.__dict__
Out[11]: {'x': 2}
通过上面的演示可以很清楚地看出:Python将对象的自定义成员以键值对的形式保存到dict字典中,而前面提到的类型定义只是这种情况的语法糖而已,即上面的类型定义等价于以下形式的定义:
Class Pclass(object): pass
Pclass.i = 1
Pclass.f = lambda x: x
访问成员变量时,Python也是从dict字典中取出变量名对应的值,如下形式的两种访问形式是等价的――在Descriptor被引入之前:
p.i
p.__dict__['i']
Descriptor的引入即将改变上面的规则,且看下文分解。
定义:Descriptor Protocol
Descriptor如何改变对象成员的访问规则呢?根据计算机理论中"绝大多数软件问题都可以用增加一个中间层的方式解决"这一名言,我们需要为对象访问提供一个中间层,而非直接访问所需的对象。实现这一中间层的方式是定义Descriptor协议。Descriptor的定义很简单,如果一个类包含以下三个方法(之一),则可以称之为一个Descriptor:
1.object.get(self, instance, owner)
成员被访问时调用,instance为成员所属的对象、owner为instance所属的类型
2.object.set(self, instance, value)
成员被赋值时调用
3.0object.delete(self, instance)
成员被删除时调用
如果我们需要改变一个对象在其它对象中的访问规则,需要将其定义成Descriptor,之后在对该成员进行访问时将调用该Descriptor的相应函数。下面是一个使用Descriptor改变访问规则的例子:
class MyDescriptor(object):
def __init__(self, x):
self.x = x
def __get__(self, instance, owner):
print 'get from descriptor'
return self.x
def __set__(self, instance, value):
print 'set from descriptor'
self.x = value
def __delete__(self, instance)
print 'del from descriptor, the val is', self.x
class C(object):
d = MyDescriptor('hello')
>> C.d
get from descriptor
>> c = C()
>> c.d
get from descriptor
>> c.d = 1
set from descriptor
>> del c.d
del from descriptor, the val is 1
从例子中可以看出:当我们对对象成员进行引用(Reference)、赋值(Assign)和删除(Dereference)操作时,如果对象成员为一个Descriptor,则这些操作将执行该Descriptor对象的相应成员函数。以上约定即为Descriptor协议。
obj.name背后的魔法
引入了Descriptor之后,Python对于对象成员访问的规则是怎样的呢?在回答这一问题之前,需要对Descriptor进行简单的划分:
Overriding或Data:对象同时提供了get和set方法
Nonoverriding或Non-Data:对象仅提供了get方法
(del方法表示自己被忽略了,很伤心~)
下面是从一个类对象中访问其成员(如C.name)的规则:
如果"name"在C.dict能找到,C.name将访问C.dict['name'],假设为v。如果v是一个Descriptor,则返回type(v).get(v, None, C),否则直接返回v;
如果"name"不在C.dict中,则向上查找C的父类,根据MRO(Method Resolution Order)对C的父类重复第一步;
还是没有找到"name",抛出AttributeError异常。
从一个类实例对象中访问其成员(如x.name,type(x)为C)要稍微复杂一些:
如果"name"能在C(或C的父类)中找到,且其值v为一个Overriding Descriptor,则返回type(v).get(v, x, C)的值;
否则,如果"name"能在x.dict中找到,则返回x.dict['name']的值;
如果"name"仍未找到,则执行类对象成员的查找规则;
如果C定义了getattr函数,则调用该函数;否则抛出AttributeError异常。
成员赋值的查找规则与访问规则类似,但还是有一点区别:对类成员执行赋值操作时将直接设置C.dict中的值,而不会调用Descriptor的set函数。
以上面的代码为例,当访问C.d时,Python将在C.dict中找到d,并且发现d是一个Descriptor,因此将调用d.get(None, C);当访问c.d时,Python首先查找C,并且在其中发现d的定义,且d为一个Overriding Descriptor,因此执行d.get(c, C)。
前面介绍了Descriptor的一些细节,那么Descriptor的作用是什么呢?在Python中,Descriptor主要用来实现一些Python本身的功能,如类方法调用、staticmethod和Property等。下面将对这些使用Descriptor进行类方法调用的实现进行介绍。
Bound & Unbound Method
在python中,函数是第一级的对象,即其本质与其它对象相同,差别在于函数对象是callable对象,即对于函数对象f,可以用语法f()来调用函数。上面提到的对象成员访问规则,对于函数来说是完全一样的。Python在实现成员函数调用时obj.f()时,会执行一下两个步骤:
根据对象成员访问规则获取函数对象;
用函数对象执行函数调用;
为了验证上述过程,我们可以执行以下代码:
Class C(object):
def f(self):
pass
>> fun = C.f
Unbound Method
>> fun()
>> c = C()
>> fun = c.f
Bound Method
>> fun()
我们可以看到C.f和c.f返回了instancemethod类型的对象,这两个对象也是可调用的,但是却不是我们本以为的func对象。那么instancemethod对象和func对象之间具有什么关联呢?
func类型:func类型为Python中原始的函数对象类型,即def f(): pass将定义一个func类型的对象f;
instancemethod:func的一个wrapper,如果类方法没有绑定到对象,则该instancemethod为一个Unbound Method,对Unbound Method的调用将导致TypeError错误;如果类方法绑定到了对象,则该instancemethod为一个Bound Method,对Bound Method的调用不许要指定self参数的值。
如果查看Unbound Method对象和Bound Method对象的成员,我们可以发现它们都包含了一下三个成员:im_func、im_self和im_class。其中im_func为所封装的func对象,im_self则为所绑定对象的值,而im_class则为定义该函数的类对象。由此我们可以知道,Python会根据不同的情况返回函数的不同wrapper,当通过类对象访问函数时,返回的是名为Unbound Method对象的Wrapper,而通过类实例访问函数是,返回的则是绑定了该实例的名为Bound Method对象的Wrapper。
现在是Descriptor大显身手的时候了。
Python中将func定义为一个Overriding Descriptor,在其get方法中构造一个instancemethod对象,并根据被访问函数被访问的情况设置im_func、im_self和im_class成员。在instancemethod实例被调用时,则根据im_func和im_self来完成真正的函数调用。演示这一过程的代码如下:
Class instancemethod(object):
def __call__(self, *args):
if self.im_self == None:
raise 'unbound error'
return self.im_func(self.im_self, *args)
def __init__(self, im_self, im_func, im_class):
self.im_self = im_self
self.im_func = im_func
self.im_class = im_class
class func(object):
...
def __get__(self, instance, owner):
return instancemethod(instance, self, owner)
def __set__(self, instance, value):
pass
...
一个小问题的解决
分享一下刚遇到的一个小问题,我有一段类似于这样的python代码:
# coding: utf-8
class A(object):
@property
def _value(self):
# raise AttributeError("test")
return {"v": "This is a test."}
def __getattr__(self, key):
print "__getattr__:", key
return self._value[key]
if __name__ == '__main__':
a = A()
print a.v
运行后可以得到正确的结果
__getattr__: v
This is a test.
但是注意,如果把
# raise AttributeError("test")
这行的注释去掉的话,即在_value方法里面抛出AttributeError异常,事情就会变得有些奇怪。程序运行的时候并不会抛出异常,而是会进入一个无限递归:
File "attr_test.py", line 12, in __getattr__
return self._value[key]
File "attr_test.py", line 12, in __getattr__
return self._value[key]
RuntimeError: maximum recursion depth exceeded while calling a Python object
通过多方查找后发现是property装饰器的问题,property实际上是一个descriptor。在python doc中可以发现这样的文字:
object.get(self, instance, owner)
Called to get the attribute of the owner class (class attribute access) or of an instance of that class (instance attribute access). owner is always the owner class, while instance is the instance that the attribute was accessed through, or None when the attribute is accessed through the owner. This method should return the (computed) attribute value or raise an AttributeError exception.
这样当用户访问._value时,抛出了AttributeError从而调用了getattr方法去尝试获取。这样程序就变成了无限递归。
这个问题看上去不复杂,但是当你的_value方法是比较隐晦的抛出AttributeError的话,调试起来就会比较困难了。
小结
Descriptor是访问对象成员时的一个中间层,为我们提供了自定义对象成员访问的方式。通过对Descriptor的探索,对原来的一些看似神秘的概念顿时有种豁然开朗的感觉:
类方法调用:编译器并没有为其提供专门的语法规则,而是使用Descriptor返回instancemethod来封装func,从而实现类似obj.func()的调用方式;
staticmethod:decorator将创建一个StaticMethod并在其中保存func对象,StaticMethod是一个Descriptor,其get函数中返回前面所保存的func对象;
Property:创建一个Property对象,在其get、set和delete方法中分别执行构造对象是传入的fget、fset、和fdel函数。现在知道为什么Property只提供这三个函数作为参数么。。
最后一个问题是,Python引入Descriptor之后的性能会不会有影响?性能影响是必须的:每次访问成员时的查找规则,之后再调用Descriptor的get函数,如果是方法调用的话之后才是执行真正的函数调用。每次访问对象成员时都要经历以上过程,对Python的性能应该会有较大的影响。但是,在Python的世界,貌似Pythonic才是被关注的重点,性能神马的就别提了。。
京东创始人刘强东和其妻子章泽天最近成为了互联网舆论关注的焦点。有关他们“移民美国”和在美国购买豪宅的传言在互联网上广泛传播。然而,京东官方通过微博发言人发布的消息澄清了这些传言,称这些言论纯属虚假信息和蓄意捏造。
日前,据博主“@超能数码君老周”爆料,国内三大运营商中国移动、中国电信和中国联通预计将集体采购百万台规模的华为Mate60系列手机。
据报道,荷兰半导体设备公司ASML正看到美国对华遏制政策的负面影响。阿斯麦(ASML)CEO彼得·温宁克在一档电视节目中分享了他对中国大陆问题以及该公司面临的出口管制和保护主义的看法。彼得曾在多个场合表达了他对出口管制以及中荷经济关系的担忧。
今年早些时候,抖音悄然上线了一款名为“青桃”的 App,Slogan 为“看见你的热爱”,根据应用介绍可知,“青桃”是一个属于年轻人的兴趣知识视频平台,由抖音官方出品的中长视频关联版本,整体风格有些类似B站。
日前,威马汽车首席数据官梅松林转发了一份“世界各国地区拥车率排行榜”,同时,他发文表示:中国汽车普及率低于非洲国家尼日利亚,每百户家庭仅17户有车。意大利世界排名第一,每十户中九户有车。
近日,一项新的研究发现,维生素 C 和 E 等抗氧化剂会激活一种机制,刺激癌症肿瘤中新血管的生长,帮助它们生长和扩散。
据媒体援引消息人士报道,苹果公司正在测试使用3D打印技术来生产其智能手表的钢质底盘。消息传出后,3D系统一度大涨超10%,不过截至周三收盘,该股涨幅回落至2%以内。
9月2日,坐拥千万粉丝的网红主播“秀才”账号被封禁,在社交媒体平台上引发热议。平台相关负责人表示,“秀才”账号违反平台相关规定,已封禁。据知情人士透露,秀才近期被举报存在违法行为,这可能是他被封禁的部分原因。据悉,“秀才”年龄39岁,是安徽省亳州市蒙城县人,抖音网红,粉丝数量超1200万。他曾被称为“中老年...
9月3日消息,亚马逊的一些股东,包括持有该公司股票的一家养老基金,日前对亚马逊、其创始人贝索斯和其董事会提起诉讼,指控他们在为 Project Kuiper 卫星星座项目购买发射服务时“违反了信义义务”。
据消息,为推广自家应用,苹果现推出了一个名为“Apps by Apple”的网站,展示了苹果为旗下产品(如 iPhone、iPad、Apple Watch、Mac 和 Apple TV)开发的各种应用程序。
特斯拉本周在美国大幅下调Model S和X售价,引发了该公司一些最坚定支持者的不满。知名特斯拉多头、未来基金(Future Fund)管理合伙人加里·布莱克发帖称,降价是一种“短期麻醉剂”,会让潜在客户等待进一步降价。
据外媒9月2日报道,荷兰半导体设备制造商阿斯麦称,尽管荷兰政府颁布的半导体设备出口管制新规9月正式生效,但该公司已获得在2023年底以前向中国运送受限制芯片制造机器的许可。
近日,根据美国证券交易委员会的文件显示,苹果卫星服务提供商 Globalstar 近期向马斯克旗下的 SpaceX 支付 6400 万美元(约 4.65 亿元人民币)。用于在 2023-2025 年期间,发射卫星,进一步扩展苹果 iPhone 系列的 SOS 卫星服务。
据报道,马斯克旗下社交平台𝕏(推特)日前调整了隐私政策,允许 𝕏 使用用户发布的信息来训练其人工智能(AI)模型。新的隐私政策将于 9 月 29 日生效。新政策规定,𝕏可能会使用所收集到的平台信息和公开可用的信息,来帮助训练 𝕏 的机器学习或人工智能模型。
9月2日,荣耀CEO赵明在采访中谈及华为手机回归时表示,替老同事们高兴,觉得手机行业,由于华为的回归,让竞争充满了更多的可能性和更多的魅力,对行业来说也是件好事。
《自然》30日发表的一篇论文报道了一个名为Swift的人工智能(AI)系统,该系统驾驶无人机的能力可在真实世界中一对一冠军赛里战胜人类对手。
近日,非营利组织纽约真菌学会(NYMS)发出警告,表示亚马逊为代表的电商平台上,充斥着各种AI生成的蘑菇觅食科普书籍,其中存在诸多错误。
社交媒体平台𝕏(原推特)新隐私政策提到:“在您同意的情况下,我们可能出于安全、安保和身份识别目的收集和使用您的生物识别信息。”
2023年德国柏林消费电子展上,各大企业都带来了最新的理念和产品,而高端化、本土化的中国产品正在不断吸引欧洲等国际市场的目光。
罗永浩日前在直播中吐槽苹果即将推出的 iPhone 新品,具体内容为:“以我对我‘子公司’的了解,我认为 iPhone 15 跟 iPhone 14 不会有什么区别的,除了序(列)号变了,这个‘不要脸’的东西,这个‘臭厨子’。