<small id="upkqa"></small>

<tbody id="upkqa"><pre id="upkqa"></pre></tbody>

溫馨提示×

溫馨提示×

您好，登錄后才能下訂單哦！

密碼登錄×

忘記密碼？

登錄注冊(cè)×

獲取短信驗(yàn)證碼

其他方式登錄

點(diǎn)擊登錄注冊(cè) 即表示同意《億速云用戶服務(wù)條款》

用戶登錄×

賬戶密碼登錄

請(qǐng)使用微信掃描上方二維碼

使用幫助

請(qǐng)求超時(shí)！

請(qǐng)點(diǎn)擊重新獲取二維碼

怎么在Python 中為sorted 自定義比較邏輯

發(fā)布時(shí)間：2021-02-03 14:16:32 來源：億速云閱讀：171 作者：Leah 欄目：開發(fā)技術(shù)

怎么在Python 中為sorted 自定義比較邏輯？很多新手對(duì)此不是很清楚，為了幫助大家解決這個(gè)難題，下面小編將為大家詳細(xì)講解，有這方面需求的人可以來學(xué)習(xí)下，希望你能有所收獲。

在 Python 中對(duì)一個(gè)可迭代對(duì)象進(jìn)行排序是很常見的一個(gè)操作，一般會(huì)用到 sorted() 函數(shù)

num_list = [4, 2, 8, -9, 1, -3]
sorted_num_list = sorted(num_list)
print(sorted_num_list)

上面的代碼是對(duì)整數(shù)列表 num_list 按從小到大的順序進(jìn)行排序，得到的結(jié)果如下

[-9, -3, 1, 2, 4, 8]

有時(shí)候不僅僅是對(duì)元素本身進(jìn)行排序，而是在元素值的基礎(chǔ)上進(jìn)行一些計(jì)算之后再進(jìn)行比較，比如將 num_list 中的元素按照其平方值的大小進(jìn)行排序。

在 Python 2 中，可以通過 sorted() 函數(shù)中的 cmp 或 key 參數(shù)來實(shí)現(xiàn)這種自定義的比較邏輯。cmp 比較函數(shù)接收兩個(gè)參數(shù) x 和 y（x 和 y 都是列表中元素）并且返回一個(gè)數(shù)字，如果返回正數(shù)表示 x > y，返回 0 表示 x == y，返回負(fù)數(shù)表示 x < y。key 函數(shù)接收一個(gè)參數(shù)，重新計(jì)算出一個(gè)結(jié)果，然后用計(jì)算出的結(jié)果參與排序比較。因此在 Python 2 中按平方值大小排序可以有下面兩種實(shí)現(xiàn)方式

num_list = [4, 2, 8, -9, 1, -3]
# cmp 參數(shù)只在 Python 2 中存在，Python 3 及之后的版本移除了 cmp 參數(shù)
sorted_num_list = sorted(num_list, cmp=lambda x, y: x ** 2 - y ** 2)
sorted_num_list = sorted(num_list, key=lambda x: x ** 2)

但是隨著 Python 3.0 的發(fā)布，cmp 參數(shù)也隨之被移除了，也就是說在 Python 3 中自定義比較邏輯就只能通過 key 參數(shù)來實(shí)現(xiàn)。至于為什么將 cmp 參數(shù)移除，在 Python 的 Issue tracker 中有一段很長(zhǎng)的討論，主要有以下兩點(diǎn)原因

cmp 是一個(gè)冗余參數(shù)，所有使用 cmp 的場(chǎng)景都可以用 key 來代替
使用 key 比使用 cmp 的性能更快，對(duì)于有 N 個(gè)元素的列表，在排序過程中如果調(diào)用 cmp 進(jìn)行比較，那么 cmp 的調(diào)用次數(shù)為 Nlog(N) 量級(jí)（基于比較的排序的最快時(shí)間復(fù)雜度），如果使用 key 參數(shù)，那么只需要在每個(gè)元素上調(diào)用一次 key 函數(shù)，只有 N 次調(diào)用，雖然使用 key 參數(shù)也要進(jìn)行 O(Nlog(N)) 量級(jí)比較次數(shù)，但這些比較是在 C 語(yǔ)言層，比調(diào)用用戶自定義的函數(shù)快。

關(guān)于上面性能的問題，我做了一個(gè)實(shí)驗(yàn)，分別隨機(jī)生成 1000、10000、100000 和 1000000 個(gè)整數(shù)，然后用 key 和 cmp 的方式分別進(jìn)行排序并記錄排序的時(shí)間消耗

import random
import time

counts = (1000, 10000, 100000, 1000000)

def custom_cmp(x, y):
  return x ** 2 - y ** 2

def custom_key(x):
  return x ** 2

print('%7s%20s%20s' % ('count', 'cmp_duration', 'key_duration'))
for count in counts:
  min_num = -count // 2
  max_num = count // 2
  nums = [random.randint(min_num, max_num) for _ in range(count)]
  start = time.time()
  sorted(nums, cmp=custom_cmp)
  cmp_duration = time.time() - start
  start = time.time()
  sorted(nums, key=custom_key)
  key_duration = time.time() - start
  print('%7d%20.2f%20.2f' % (count, cmp_duration, key_duration))

在我的筆記本上一次運(yùn)行結(jié)果如下

 count    cmp_duration    key_duration
  1000        0.00        0.00
 10000        0.02        0.01
 100000        0.34        0.11
1000000        4.75        1.85

可以看到，當(dāng)列表中數(shù)字的數(shù)量超過 100000 的時(shí)候，使用 key 函數(shù)的性能優(yōu)勢(shì)就非常明顯了，比 cmp 快了 2~3 倍。

對(duì)于熟悉 Java 或 C++ 等其他編程語(yǔ)言的同學(xué)來說，可能更熟悉 cmp 的比較方式。其實(shí) Python 3 中也可以通過 functools 工具包中的 cmp_to_key() 函數(shù)來將 cmp 轉(zhuǎn)換成 key，從而使用接收兩個(gè)參數(shù)的自定義比較函數(shù) cmp。

import functools

num_list = [4, 2, 8, -9, 1, -3]

def custom_cmp(x, y):
  return x ** 2 - y ** 2

sorted_num_list = sorted(num_list, key=functools.cmp_to_key(custom_cmp))
print(sorted_num_list)

那么，cmp_to_key() 函數(shù)是如何將 cmp 轉(zhuǎn)換成 key 的呢，我們可以通過源碼一探究竟

def cmp_to_key(mycmp):
  """Convert a cmp= function into a key= function"""
  class K(object):
    __slots__ = ['obj']
    def __init__(self, obj):
      self.obj = obj
    def __lt__(self, other):
      return mycmp(self.obj, other.obj) < 0
    def __gt__(self, other):
      return mycmp(self.obj, other.obj) > 0
    def __eq__(self, other):
      return mycmp(self.obj, other.obj) == 0
    def __le__(self, other):
      return mycmp(self.obj, other.obj) <= 0
    def __ge__(self, other):
      return mycmp(self.obj, other.obj) >= 0
    __hash__ = None
  return K

其實(shí) cmp_to_key() 返回的是一個(gè)類 K，只不過在類 K 中重載了各種比較運(yùn)算符，重載的過程中使用到了自定義的比較函數(shù) mycmp，使得 K 的大小比較邏輯與 mycmp 一致。這樣，對(duì)于 num_list 中的每個(gè)元素 num 都會(huì)執(zhí)行一次 K(num) 生成一個(gè)類 K 的實(shí)例，然后通過比較不同 K 的實(shí)例的大小進(jìn)行排序。

雖然通過 cmp_to_key() 可以調(diào)用自定義的 cmp 函數(shù)，但是還是要優(yōu)先使用 key 函數(shù)，因?yàn)橥ㄟ^ cmp_to_key() 方式會(huì)在排序過程中創(chuàng)建很多類 K 的實(shí)例，對(duì)性能有很大影響，下面是 cmp_to_key() 和 key 的性能比較

 count     cmp_to_key    key_duration
  1000        0.01        0.00
 10000        0.10        0.01
 100000        1.36        0.09
1000000        16.89        1.13

當(dāng) num_list 中的數(shù)量為 1000000 的時(shí)候 key 比 cmp_to_key 快了將近 15 倍。

本文主要介紹了如何在 sorted 函數(shù)中自定義比較邏輯，Python 2 中可以通過 cmp 或 key 來實(shí)現(xiàn)，cmp 接收 2 個(gè)參數(shù)，通過返回的數(shù)值來判斷兩個(gè)參數(shù)的大小，key 重新計(jì)算一個(gè)新的結(jié)果參與比較。在 Python 3 中，考慮到 cmp 的性能和冗余的原因，將其移除了。在 Python 3.2 中提供了 functools.cmp_to_key 這個(gè)函數(shù)來使用自定義的比較函數(shù) cmp，但是出于性能的考慮，我們還是要優(yōu)先使用 key 來進(jìn)行排序。

看完上述內(nèi)容是否對(duì)您有幫助呢？如果還想對(duì)相關(guān)知識(shí)有進(jìn)一步的了解或閱讀更多相關(guān)文章，請(qǐng)關(guān)注億速云行業(yè)資訊頻道，感謝您對(duì)億速云的支持。

向AI問一下細(xì)節(jié)

推薦閱讀：

免責(zé)聲明：本站發(fā)布的內(nèi)容（圖片、視頻和文字）以原創(chuàng)、轉(zhuǎn)載和分享為主，文章觀點(diǎn)不代表本網(wǎng)站立場(chǎng)，如果涉及侵權(quán)請(qǐng)聯(lián)系站長(zhǎng)郵箱：is@yisu.com進(jìn)行舉報(bào)，并提供相關(guān)證據(jù)，一經(jīng)查實(shí)，將立刻刪除涉嫌侵權(quán)內(nèi)容。

上一篇新聞：
電腦如何查看網(wǎng)絡(luò)地址
下一篇新聞：
css中什么指的是內(nèi)聯(lián)元素

猜你喜歡

AI
助
手

產(chǎn)品服務(wù)

地區(qū)劃分

專題活動(dòng)

幫助支持

關(guān)于我們

售后咨詢

7*24小時(shí)在線電話：400-100-2938

7*24小時(shí)在線 QQ：800811969

關(guān)注億速云

億速云公眾號(hào)

手機(jī)網(wǎng)站二維碼

<code id="3nhut"><small id="3nhut"></small></code>

<option id="3nhut"><small id="3nhut"><ul id="3nhut"></ul></small></option>

<strike id="3nhut"><tbody id="3nhut"></tbody></strike>