Python中可以hash的数据类型

梵高1年前 (2023-11-21)阅读数 27#技术干货

文章标签您的

在Python中，仅仅只有不可变数据类型可以被hash,然而每个自定义的对象在Python中都可以被hash，默认的他们的hash值是由他们的id派生的。也就意味着，同一个类的两个不同实例，默认的是得到不同的hash值

>>>classCar():

...velocity=0

...direction=0

...damage=0

...

>>>first_car=Car()

>>>second_car=Car()

>>>hash(first_car)

274643597

>>>hash(second_car)

274643604

哈希表

现在你知道了什么是哈希函数，现在可以检测哈希表，哈希表是一个数据结构可以储存一堆键值对。

在哈希表中，键值对的所有建必须是可以哈希的，因为存储的对是通过使用其键的散列索引的。哈希表十分有用，Hashtablesareveryusefulbecausetheaveragenumberofinstructionsthatarenecessarytolookupanelementofthetableisindependentofthenumberofelementsstoredinthetableitself.哈希表非常有用，因为查找表中某个元素所需的平均指令数量与表中存储的元素数量无关，这就表明了不管你的表增长到成百上千次，查找特定元素的速度不会受到影响。

哈希表通常是通过创建可变数量的存储桶来实现的，这些存储桶将包含您的数据，并通过哈希它们的键对这些数据进行索引。键的散列值将确定用于特定数据段的正确存储桶。

importpprint

classHashtable:

def__init__(self,elements):

self.bucket_size=len(elements)

self.buckets=[[]foriinrange(self.bucket_size)]

self._assign_buckets(elements)

def_assign_buckets(self,elements):

forkey,valueinelements:

hashed_value=hash(key)

index=hashed_value%self.bucket_size

self.buckets[index].append((key,value))

defget_value(self,input_key):

hashed_value=hash(input_key)

index=hashed_value%self.bucket_size

bucket=self.buckets[index]

forkey,valueinbucket:

ifkey==input_key:

return(value)

returnNone

def__str__(self):

returnpprint.pformat(self.buckets)#herepformatisusedtoreturnaprintablerepresentationoftheobject

if__name__=="__main__":

capitals=[

('France','Paris'),

('UnitedStates','WashingtonD.C.'),

Python中可以hash的数据类型

('Italy','Rome'),

('Canada','Ottawa')

]

hashtable=Hashtable(capitals)

print(hashtable)

print(f"ThecapitalofItalyis{hashtable.get_value('Italy')}")

Moreover,themoreyouincreasethenumberofbucketsyouwillhandle,themorespaceyouwillwaste.Totestthisyoucansimplychangethebucketsizeofyourpreviousexampleusinganumberofbucketsthatistwotimesthelengthoftheinputlist:

此外，处理的桶数增加越多，浪费的空间就越多。要测试这一点，只需使用输入列表长度的两倍的桶数来更改上一个示例的桶大小

两个散列值发生碰撞，将会存储到同一个桶中，因为冲突不可避免，实现一个哈希表就得有一个解决冲突的方法。

通常在哈希表解决冲突的常用策略是：

openaddressing开放寻址法

separatechaining链地址法

连地址法是您在上面的示例中已经实现的，它由使用另一个数据结构在同一个bucket中创建一个值链组成。在那个示例中，您使用了一个嵌套列表，当在超额占用的bucket中查找特定值时，必须对该列表进行完全扫描。

在开放寻址策略中，如果您应该使用的bucket是忙碌的，那么您只需继续搜索要使用的新bucket。要实现这个解决方案，您需要对为新元素分配bucket的方式和检索键值的方式进行一些更改。从assignbuckets()函数开始，您必须使用默认值初始化您的bucket，并且如果您应该使用的bucket已经被占用，则继续寻找空的bucket

以上内容为大家介绍了Python中可以hash的数据类型，希望对大家有所帮助，如果想要了解更多Python相关知识，请关注IT培训机构:开发教育。

鹏仔微信 15129739599 鹏仔QQ344225443 鹏仔前端 pjxi.com 共享博客 sharedbk.com

免责声明：我们致力于保护作者版权，注重分享，当前被刊用文章因无法核实真实出处，未能及时与作者取得联系，或有版权异议的，请联系管理员，我们会立即处理! 部分文章是来自自研大数据AI进行生成,内容摘自(百度百科,百度知道,头条百科,中国民法典,刑法,牛津词典,新华词典,汉语词典,国家院校,科普平台)等数据,内容仅供学习参考,不准确地方联系删除处理!邮箱：344225443@qq.com)

图片声明：本站部分配图来自网络。本站只作为美观性配图使用,无任何非法侵犯第三方意图,一切解释权归图片著作权方,本站不承担任何责任。如有恶意碰瓷者,必当奉陪到底严惩不贷!

内容声明：本文中引用的各种信息及资料（包括但不限于文字、数据、图表及超链接等）均来源于该信息及资料的相关主体（包括但不限于公司、媒体、协会等机构）的官方网站或公开发表的信息。部分内容参考包括:(百度百科,百度知道,头条百科,中国民法典,刑法,牛津词典,新华词典,汉语词典,国家院校,科普平台)等数据,内容仅供参考使用,不准确地方联系删除处理！本站为非盈利性质站点,本着为中国教育事业出一份力,发布内容不收取任何费用也不接任何广告!)